Devlery

Blog

AI 뉴스와 코딩 에이전트, LLM, AI 인프라의 변화를 기록합니다.

GPT-5.5가 50%를 넘었다, 기업 문서 에이전트의 진짜 병목

GPT-5.5가 50%를 넘었다, 기업 문서 에이전트의 진짜 병목

Databricks OfficeQA Pro에서 GPT-5.5가 50% 정확도를 넘었습니다. 기업 에이전트의 병목은 추론보다 문서 파싱과 권한 있는 오케스트레이션입니다.

업무시간 밖 티켓 47%, Freshworks가 노린 에이전트 야간 근무

업무시간 밖 티켓 47%, Freshworks가 노린 에이전트 야간 근무

Freshworks AI Agent Studio는 ITSM을 AI 에이전트의 실행 계층으로 바꾸려는 시도입니다. MCP Gateway와 xLA가 그 핵심입니다.

Codex 모바일 원격 제어, 개발 루프의 새 승인 버튼

Codex 모바일 원격 제어, 개발 루프의 새 승인 버튼

OpenAI Codex가 모바일 원격 제어와 자동화 토큰을 추가하며 코딩 에이전트의 실행, 승인, 감사 흐름을 재설계하고 있습니다.

Honeycomb, AI 에이전트 관측성을 운영 계층으로 끌어올렸다

Honeycomb, AI 에이전트 관측성을 운영 계층으로 끌어올렸다

Honeycomb Agent Timeline 출시는 AI 에이전트 운영의 병목이 모델 성능에서 trace, 비용, 정책 증거로 이동했음을 보여줍니다.

PwC가 Claude를 수십만 명에게 배포한다

PwC가 Claude를 수십만 명에게 배포한다

Anthropic과 PwC의 확장 제휴는 Claude Code와 Cowork를 전문서비스 전달망에 심는 엔터프라이즈 에이전트 전략입니다.

Copilot Max 등장, AI 코딩도 크레딧 장부로 간다

Copilot Max 등장, AI 코딩도 크레딧 장부로 간다

GitHub Copilot이 AI Credits와 Max 플랜을 도입합니다. 코딩 에이전트 비용이 월정액에서 사용량 기반 인프라로 이동합니다.

Honeycomb Agent Timeline, 에이전트 장애를 되감는 관측 계층

Honeycomb Agent Timeline, 에이전트 장애를 되감는 관측 계층

Honeycomb Agent Timeline은 AI 에이전트의 LLM 호출, 도구 사용, handoff, 시스템 장애를 하나의 production timeline으로 묶습니다.

Fiserv agentOS, 은행 AI 에이전트의 운영체제를 표방하다

Fiserv agentOS, 은행 AI 에이전트의 운영체제를 표방하다

Fiserv가 OpenAI·AWS와 함께 은행용 agentOS를 발표했습니다. 금융권 AI 에이전트 경쟁이 모델에서 운영·감사·마켓플레이스로 이동합니다.

Anthropic Gates 2억 달러, Claude는 시장 밖으로 간다

Anthropic Gates 2억 달러, Claude는 시장 밖으로 간다

Anthropic과 Gates Foundation의 2억 달러 파트너십은 Claude credits, connectors, 공개 벤치마크를 묶은 공익 AI 배치 실험입니다.

Claude 구독의 공짜 자동화가 끝난다, Agent SDK 과금 분리

Claude 구독의 공짜 자동화가 끝난다, Agent SDK 과금 분리

Anthropic이 6월 15일부터 Claude Agent SDK와 claude -p를 별도 월간 크레딧으로 분리합니다. AI 코딩 자동화 비용 구조가 바뀝니다.

Codex Windows 샌드박스, 로컬 에이전트 보안의 기준선

Codex Windows 샌드박스, 로컬 에이전트 보안의 기준선

OpenAI가 공개한 Codex Windows 샌드박스 설계는 로컬 코딩 에이전트 보안이 모델 문제가 아니라 OS 경계 문제가 됐음을 보여줍니다.

Baidu DAA, 에이전트 시대의 새 지표를 꺼낸 이유

Baidu DAA, 에이전트 시대의 새 지표를 꺼낸 이유

Baidu가 Create 2026에서 Daily Active Agents를 제안했습니다. 토큰 소비가 아니라 실제로 일하는 에이전트 수가 플랫폼 경쟁 지표가 됩니다.