Devlery

Blog

AI 뉴스와 코딩 에이전트, LLM, AI 인프라의 변화를 기록합니다.

99.82% 캐시 적중, 코딩 에이전트 비용표의 새 변수

99.82% 캐시 적중, 코딩 에이전트 비용표의 새 변수

Reasonix 논쟁은 코딩 에이전트 비용이 모델 가격뿐 아니라 prefix cache를 깨지 않는 하네스 설계에 달렸음을 보여줍니다.

감시자가 놓친 20개 공격, SLEIGHT-Bench의 에이전트 보안 경고

감시자가 놓친 20개 공격, SLEIGHT-Bench의 에이전트 보안 경고

SLEIGHT-Bench는 LLM 모니터가 코딩 에이전트의 위험 행동을 얼마나 쉽게 놓치는지 40개 합성 공격으로 드러냅니다.

IDE 선택 시대, 코딩 에이전트 시장의 새 평가표

IDE 선택 시대, 코딩 에이전트 시장의 새 평가표

Gartner와 OpenAI 발표는 AI 코딩 에이전트 경쟁축이 모델 성능에서 거버넌스, 비용, 감사 가능한 운영으로 옮겨가고 있음을 보여줍니다.

Copilot 원격 조종, 코딩 에이전트 비용표의 새 조건

Copilot 원격 조종, 코딩 에이전트 비용표의 새 조건

GitHub Copilot CLI 원격 제어와 자동 모델 라우팅은 코딩 에이전트를 IDE 기능이 아니라 운영 대상 세션으로 바꿉니다.

x402 2,424만 달러, 에이전트 지갑의 책임 청구서

x402 2,424만 달러, 에이전트 지갑의 책임 청구서

Circle Agent Stack은 AI 에이전트가 USDC로 API와 서비스를 결제하는 흐름을 열지만, 책임과 보안 경계도 함께 드러냅니다.

분당 150억 토큰, OpenAI 슈퍼앱 전략의 진짜 비용

분당 150억 토큰, OpenAI 슈퍼앱 전략의 진짜 비용

OpenAI의 1,220억 달러 조달은 ChatGPT, Codex, API, 컴퓨트를 하나의 에이전트 슈퍼앱으로 묶는 전략입니다.

2개 H100이면 충분하다, Command A+가 겨냥한 사설 에이전트

2개 H100이면 충분하다, Command A+가 겨냥한 사설 에이전트

Cohere Command A+는 Apache 2.0 오픈 가중치와 2개 H100 배포 조건으로 사설 에이전트 경쟁의 기준을 낮추려 합니다.

Android Skills, 에이전트가 앱 규칙을 배우는 새 방식

Android Skills, 에이전트가 앱 규칙을 배우는 새 방식

Android Studio I/O Edition의 Agent Skills와 Android CLI는 모바일 앱 개발을 에이전트가 읽는 지식 계층으로 바꿉니다.

6월 18일 Gemini CLI 단절, 오픈소스 에이전트의 대가

6월 18일 Gemini CLI 단절, 오픈소스 에이전트의 대가

Google이 Gemini CLI 개인 사용자를 Antigravity CLI로 전환합니다. 10만 스타 오픈소스 에이전트가 플랫폼에 흡수되는 순간입니다.

Stainless 인수, 에이전트 전쟁의 배관을 쥔 Anthropic

Stainless 인수, 에이전트 전쟁의 배관을 쥔 Anthropic

Anthropic의 Stainless 인수는 SDK, CLI, MCP 서버 생성기가 에이전트 플랫폼 경쟁의 핵심 배관이 됐음을 보여줍니다.

4백만 Codex, 온프레미스가 된 코딩 에이전트의 조건

4백만 Codex, 온프레미스가 된 코딩 에이전트의 조건

OpenAI와 Dell의 Codex 온프레미스 협력은 코딩 에이전트 경쟁이 모델 성능보다 기업 컨텍스트 경계로 옮겨감을 보여줍니다.

4GB Gemini Nano 논쟁, 브라우저가 모델 배포자가 된 순간

4GB Gemini Nano 논쟁, 브라우저가 모델 배포자가 된 순간

Chrome의 Gemini Nano 다운로드 논쟁은 온디바이스 AI가 동의, 저장공간, 업데이트 UX를 요구하는 플랫폼 문제가 됐음을 보여줍니다.