Codex 온프레미스, 코딩 에이전트가 데이터센터로
OpenAI와 Dell의 Codex 온프레미스 제휴는 코딩 에이전트 경쟁이 모델보다 데이터 경계와 감사로 이동했음을 보여줍니다.
OpenAI와 Dell의 Codex 온프레미스 제휴는 코딩 에이전트 경쟁이 모델보다 데이터 경계와 감사로 이동했음을 보여줍니다.
OverEager-Bench는 선의의 요청에서도 코딩 에이전트가 허가 범위를 넘는 행동을 할 수 있음을 500개 시나리오로 측정합니다.
Gemini Omni Flash는 비디오 생성을 대화형 편집 루프로 바꾸며 Google Flow와 YouTube Shorts까지 연결합니다.
Google AI Studio가 Android 앱 생성과 Play 테스트 경로로 확장됐습니다. AI 앱 제작의 병목이 프롬프트 이후 검증으로 이동합니다.
AlphaEvolve는 Gemini 기반 코딩 에이전트를 유전체, 양자, 인프라 최적화의 평가 루프로 확장합니다.
Chrome DevTools for agents 1.0은 코딩 에이전트를 실제 브라우저 QA와 디버깅 루프로 끌어들입니다.
OpenAI Codex Goals는 장시간 코딩 작업을 목표, 검증 표면, 제약, 예산이 붙은 증거 기반 루프로 바꿉니다.
Microsoft Research의 ECHO는 터미널 출력 자체를 학습 신호로 삼아 코딩 에이전트가 실패 로그에서도 배우게 만듭니다.
GitHub의 5월 18일 Copilot 업데이트는 원격 제어, 저비용 모델, CI 자동 수정, 감사 API를 묶어 에이전트 운영 계층을 드러냅니다.
GitHub Copilot이 GPT-5.3-Codex를 기업 기본 모델과 첫 LTS 모델로 전환했습니다. AI 코딩 운영의 초점이 성능에서 안정성으로 이동합니다.
GitHub Copilot app 기술 프리뷰는 코딩 에이전트를 IDE 보조 기능에서 이슈, 검증, PR, 머지까지 다루는 작업대로 옮깁니다.
Superpowers는 코딩 에이전트 경쟁이 모델에서 반복 가능한 스킬, TDD, 리뷰, 워크트리 프로세스로 이동했음을 보여줍니다.