Grok 4.5, 토큰 4배 아끼는 코딩 모델에 붙은 학습 오염 자백
xAI가 Cursor 세션 데이터로 학습한 Grok 4.5를 공개했다. 입력 100만 토큰당 2달러, 작업당 출력 토큰은 Opus 4.8의 4분의 1이다. 공개 벤치마크 4개 중 2개만 우위였고 CursorBench 학습 오염을 스스로 인정했다.
xAI가 Cursor 세션 데이터로 학습한 Grok 4.5를 공개했다. 입력 100만 토큰당 2달러, 작업당 출력 토큰은 Opus 4.8의 4분의 1이다. 공개 벤치마크 4개 중 2개만 우위였고 CursorBench 학습 오염을 스스로 인정했다.
Kurrent Capacitor는 Claude Code, Codex, Cursor 세션을 팀 단위 메모리와 PR 리뷰 문맥으로 저장합니다.
Salt Code가 MCP로 Cursor, Codex, Claude Code 안에 보안 정책을 넣습니다. AI 코드 리뷰 병목을 생성 시점에서 다루려는 시도입니다.
Cursor 3.6 Auto-review Run Mode는 Shell, MCP, Fetch 실행을 allowlist, sandbox, classifier subagent, 사용자 승인으로 나눕니다.
Cursor와 Endor Labs가 hooks 기반 보안 제휴를 공식화했습니다. 패키지 설치, MCP, 명령 실행을 IDE agent loop 안에서 차단합니다.
Faire가 Cursor Cloud Agents로 주간 PR 처리량 2배, 주 2,000회 자동 실행을 공개했습니다. 병목은 모델보다 환경·권한·워크플로입니다.
agentmemory는 Claude Code, Codex, Cursor가 같은 로컬 메모리를 공유하는 방향으로 코딩 에이전트의 세션 단절 문제를 겨냥합니다.
Gartner의 기업 AI 코딩 에이전트 평가와 OpenAI, Cursor, GitHub 발표는 AI 코딩 경쟁이 모델 성능에서 거버넌스와 조달로 이동했음을 보여줍니다.
Cursor Cloud Agent 회고는 코딩 에이전트 경쟁이 모델보다 VM, Temporal, 인덱싱, 권한, self-healing 운영층으로 이동했음을 보여줍니다.
Cursor Composer 2.5는 새 코딩 모델보다 에이전트 실행 단가, 합성 RL, IDE 내부 도구 루프를 함께 바꾼 신호입니다.
Cursor Composer 2.5는 코딩 에이전트 경쟁이 벤치마크 점수에서 긴 작업의 실패 지점과 보상 해킹 감시로 이동했음을 보여줍니다.
Cursor가 cloud agent development environments를 공개했습니다. 코딩 에이전트 경쟁의 병목이 모델에서 멀티 리포 환경, secret, egress 통제로 내려옵니다.