Devlery

Blog

AI 뉴스와 코딩 에이전트, LLM, AI 인프라의 변화를 기록합니다.

GitHub Agentic Workflows 공개, 이슈 분류를 맡는 Actions 에이전트

GitHub Agentic Workflows 공개, 이슈 분류를 맡는 Actions 에이전트

GitHub Agentic Workflows가 public preview로 올라왔습니다. Markdown으로 저장소 업무를 정의하고 Actions에서 에이전트를 실행하는 구조를 봅니다.

OpenAI의 Ona 인수, Codex 장시간 작업의 클라우드 컴퓨터

OpenAI의 Ona 인수, Codex 장시간 작업의 클라우드 컴퓨터

OpenAI가 Ona 인수를 발표했습니다. Codex가 노트북 세션을 넘어 고객 통제형 클라우드에서 장시간 작업하는 기반을 봅니다.

OCI 약정으로 Codex를 산다, OpenAI 조달의 새 경로

OCI 약정으로 Codex를 산다, OpenAI 조달의 새 경로

OpenAI와 Oracle이 OCI Marketplace로 모델과 Codex 구매 경로를 열었습니다. 개발팀 AI 도입 병목이 계약과 거버넌스로 이동합니다.

DiffusionGemma 공개, 256토큰 병렬 생성의 속도 조건

DiffusionGemma 공개, 256토큰 병렬 생성의 속도 조건

Google이 DiffusionGemma를 공개했습니다. 256토큰 canvas, vLLM 지원, 18GB VRAM 조건이 로컬 추론 병목을 어떻게 바꾸는지 봅니다.

Copilot CLI 보안 리뷰, 커밋 전 diff 검사 표준

Copilot CLI 보안 리뷰, 커밋 전 diff 검사 표준

GitHub Copilot CLI가 /security-review를 공개했습니다. PR 이후가 아니라 로컬 diff 단계에서 AI 보안 검사를 붙이는 변화입니다.

Xcode 27이 MCP를 품었다, Apple 개발자의 에이전트 선택권

Xcode 27이 MCP를 품었다, Apple 개발자의 에이전트 선택권

Apple이 Xcode 27과 Foundation Models를 확장해 MCP, ACP, Gemini, Claude, OpenAI 에이전트를 개발자 workflow 안으로 들였습니다.

Claude 코드 80%, Anthropic이 요구한 검증 가능한 일시정지

Claude 코드 80%, Anthropic이 요구한 검증 가능한 일시정지

Anthropic은 Claude가 merge 코드 80% 이상을 쓴다고 밝혔습니다. recursive self-improvement보다 검증 가능한 일시정지가 쟁점입니다.

Claude Fable 5 공개, Mythos급 모델의 안전장치 가격표

Claude Fable 5 공개, Mythos급 모델의 안전장치 가격표

Anthropic이 Fable 5와 Mythos 5를 공개했습니다. 같은 기반 모델을 안전장치, 제한 접근, 가격, 클라우드 보관 조건으로 나눴습니다.

Vercel Sandbox Drives 베타, 사라지는 VM 밖의 작업 폴더

Vercel Sandbox Drives 베타, 사라지는 VM 밖의 작업 폴더

Vercel Sandbox Drives가 private beta로 나왔습니다. AI 에이전트가 쓰는 일회용 microVM과 오래 사는 작업공간을 분리합니다.

ChatGPT Lockdown Mode 공개, 에이전트 웹 접근을 끊는 보안 스위치

ChatGPT Lockdown Mode 공개, 에이전트 웹 접근을 끊는 보안 스위치

OpenAI가 Lockdown Mode를 전체 로그인 사용자로 확대했습니다. prompt injection 방어를 위해 웹, 에이전트, 파일 다운로드를 제한합니다.

Work IQ API 6월 16일 GA, M365 에이전트의 10개 도구

Work IQ API 6월 16일 GA, M365 에이전트의 10개 도구

Microsoft Work IQ APIs가 6월 16일 GA로 갑니다. M365 업무 문맥, MCP 도구 축소, Copilot Credits 비용을 봅니다.

Google RAG 정확도 34% 향상, 답변 전 근거 부족 검사

Google RAG 정확도 34% 향상, 답변 전 근거 부족 검사

Google Research가 Gemini Enterprise Agent Platform의 Agentic RAG를 공개했습니다. cross-corpus 검색과 충분한 근거 검사를 봅니다.