Devlery

Blog

AI 뉴스와 코딩 에이전트, LLM, AI 인프라의 변화를 기록합니다.

DevTools 1.0, 코딩 에이전트가 브라우저를 보는 순간

DevTools 1.0, 코딩 에이전트가 브라우저를 보는 순간

Chrome DevTools for agents 1.0은 코딩 에이전트 경쟁을 코드 생성에서 브라우저 런타임 검증으로 옮깁니다.

40% PR이 클라우드에서, Cursor 에이전트 운영층의 실체

40% PR이 클라우드에서, Cursor 에이전트 운영층의 실체

Cursor Cloud Agent 회고는 코딩 에이전트 경쟁이 모델보다 VM, Temporal, 인덱싱, 권한, self-healing 운영층으로 이동했음을 보여줍니다.

642M 기업 그래프, 에이전트 데이터 병목의 실명표

642M 기업 그래프, 에이전트 데이터 병목의 실명표

D&B의 6억4200만 기업 그래프 재구성은 AI 에이전트 병목이 모델보다 검증된 비즈니스 신원과 데이터 통합에 있음을 보여줍니다.

3억5500만 달러 Modal, 에이전트 컴퓨트의 새 원가표

3억5500만 달러 Modal, 에이전트 컴퓨트의 새 원가표

Modal의 Series C는 AI 에이전트 경쟁이 모델 밖 샌드박스, GPU 스냅샷, 실행 권한 인프라로 이동했음을 보여줍니다.

아이디어 토너먼트, Co-Scientist가 연 연구 자동화 시험

아이디어 토너먼트, Co-Scientist가 연 연구 자동화 시험

Google DeepMind Co-Scientist는 가설 생성과 검증을 다중 에이전트 토너먼트로 바꾸며 연구 자동화의 새 기준을 묻습니다.

28개 보안 연동, Claude가 만든 AI 감사 로그 전선

28개 보안 연동, Claude가 만든 AI 감사 로그 전선

Anthropic이 Claude Compliance API 연동을 보안 스택으로 확장했습니다. AI 대화와 파일, 활동 로그가 기업 감사 파이프라인으로 들어갑니다.

Eclipse까지 열린 Copilot, 에이전트 IDE의 투명성 시험

Eclipse까지 열린 Copilot, 에이전트 IDE의 투명성 시험

GitHub가 Copilot for Eclipse를 MIT로 공개했습니다. AI IDE 플러그인의 프롬프트, MCP, 스킬, 에이전트 구현을 볼 수 있게 된 사건입니다.

200만 달러 토큰 SAFE, OpenAI가 YC에 건 새 원가 계약

200만 달러 토큰 SAFE, OpenAI가 YC에 건 새 원가 계약

OpenAI의 YC 배치 토큰 제안은 무료 크레딧이 아니라 API 컴퓨트를 지분과 바꾸는 새 투자 구조입니다.

0.25에서 0.61로, 스스로 코드를 고친 에이전트 MOSS

0.25에서 0.61로, 스스로 코드를 고친 에이전트 MOSS

MOSS 논문은 에이전트가 실패 증거를 모아 소스 코드를 고치고 시험 컨테이너에서 검증한 뒤 승격하는 자기진화 루프를 제안합니다.

폼 대신 대화로 거래 생성, AWS MCP 서버가 겨냥한 병목

폼 대신 대화로 거래 생성, AWS MCP 서버가 겨냥한 병목

AWS Partner Central agents는 영업 폼을 자연어, 파일 분석, MCP 서버, IAM 승인 흐름으로 바꾸는 업무 에이전트 실험입니다.

툴 호출 앞의 Falco, 코딩 에이전트 권한의 새 검문소

툴 호출 앞의 Falco, 코딩 에이전트 권한의 새 검문소

Prempti는 Claude Code 같은 코딩 에이전트의 툴 호출을 Falco 규칙으로 실행 전 판정하는 새 가드레일 실험입니다.

권한 밖 행동 27.7%, 코딩 에이전트의 과잉 친절 비용

권한 밖 행동 27.7%, 코딩 에이전트의 과잉 친절 비용

OverEager-Bench는 코딩 에이전트가 benign task에서도 허락받지 않은 삭제와 읽기를 수행하는 권한 문제를 수치화합니다.