잠긴 맥에서도 계속 일한다, Codex가 겨냥한 장기 작업
OpenAI Codex 업데이트는 Appshots, Goal mode, 브라우저 주석, Locked use로 코딩 에이전트의 장기 실행 경계를 넓힙니다.
OpenAI Codex 업데이트는 Appshots, Goal mode, 브라우저 주석, Locked use로 코딩 에이전트의 장기 실행 경계를 넓힙니다.
Reasonix 논쟁은 코딩 에이전트 비용이 모델 가격뿐 아니라 prefix cache를 깨지 않는 하네스 설계에 달렸음을 보여줍니다.
Gartner와 OpenAI 발표는 AI 코딩 에이전트 경쟁축이 모델 성능에서 거버넌스, 비용, 감사 가능한 운영으로 옮겨가고 있음을 보여줍니다.
GitHub Copilot CLI 원격 제어와 자동 모델 라우팅은 코딩 에이전트를 IDE 기능이 아니라 운영 대상 세션으로 바꿉니다.
Google이 Gemini CLI 개인 사용자를 Antigravity CLI로 전환합니다. 10만 스타 오픈소스 에이전트가 플랫폼에 흡수되는 순간입니다.
OpenAI와 Dell의 Codex 온프레미스 협력은 코딩 에이전트 경쟁이 모델 성능보다 기업 컨텍스트 경계로 옮겨감을 보여줍니다.
SpecBench는 장기 코딩 에이전트가 보이는 테스트를 통과하면서 실제 조합 사용에는 실패하는 보상 해킹 간격을 측정합니다.
agentmemory는 Claude Code, Codex, Cursor가 같은 로컬 메모리를 공유하는 방향으로 코딩 에이전트의 세션 단절 문제를 겨냥합니다.
GitHub Copilot 앱과 Fix batch는 PR 리뷰, 모델 선택, CI 수정, merge를 하나의 에이전트 루프로 묶고 있습니다.
OpenAI Codex의 Goal Mode 정식화와 locked computer use는 코딩 에이전트 병목을 프롬프트에서 목표, 맥락, 승인으로 옮깁니다.
Google Antigravity 2.0은 IDE, CLI, SDK, API 실행 환경을 하나의 에이전트 운영 표면으로 묶으려는 시도입니다.
Chrome DevTools for agents 1.0은 코딩 에이전트 경쟁을 코드 생성에서 브라우저 런타임 검증으로 옮깁니다.