Devlery

Blog

AI 뉴스와 코딩 에이전트, LLM, AI 인프라의 변화를 기록합니다.

GPU 세금 7배를 겨눈다, 에이전트 추론 클라우드의 조건

GPU 세금 7배를 겨눈다, 에이전트 추론 클라우드의 조건

General Compute가 에이전트용 ASIC 추론 클라우드를 일반 제공하며 GPU 중심 AI 인프라의 지연시간과 전력 병목에 도전합니다.

OpenAI와 Anthropic, 모델 전쟁은 현장 배치 전쟁으로

OpenAI와 Anthropic, 모델 전쟁은 현장 배치 전쟁으로

OpenAI와 Anthropic이 기업 AI 배치 회사를 세웠습니다. 모델 경쟁의 병목이 API가 아니라 FDE, 통합, 거버넌스로 이동합니다.

Notion Workers, 에이전트 워크스페이스의 런타임 전쟁

Notion Workers, 에이전트 워크스페이스의 런타임 전쟁

Notion이 Developer Platform을 공개했습니다. Workers, External Agents API, Agent SDK가 문서 앱을 AI 에이전트 런타임으로 바꿉니다.

Thinking Machines, AI 협업을 턴제에서 실시간으로 바꾸다

Thinking Machines, AI 협업을 턴제에서 실시간으로 바꾸다

Thinking Machines Interaction Models는 AI가 말하면서 듣고 보는 full-duplex 협업 모델을 제안합니다.

Claude Agent SDK 크레딧, 구독형 AI 에이전트의 종량제 전환

Claude Agent SDK 크레딧, 구독형 AI 에이전트의 종량제 전환

Anthropic이 Claude Agent SDK 사용량을 별도 월간 크레딧으로 분리했습니다. 코딩 에이전트 비용 모델이 구독에서 종량제로 이동합니다.

Claude가 중소기업 백오피스로 내려왔다

Claude가 중소기업 백오피스로 내려왔다

Claude for Small Business는 QuickBooks, PayPal, HubSpot, Canva를 묶어 SMB 업무를 실행하는 에이전트 패키지입니다.

26M 모델 Needle, 도구 호출을 온디바이스로 끌어내린다

26M 모델 Needle, 도구 호출을 온디바이스로 끌어내린다

Cactus Compute의 Needle은 도구 호출을 26M 파라미터 로컬 모델로 분리하려는 실험입니다. 에이전트 설계의 비용과 지연 시간을 다시 보게 합니다.

Honeycomb이 AI 에이전트의 블랙박스를 시간선으로 열었다

Honeycomb이 AI 에이전트의 블랙박스를 시간선으로 열었다

Honeycomb Agent Observability 출시는 AI 에이전트 운영의 병목이 모델 호출 로그가 아니라 handoff, tool call, 비용, 장애 재구성으로 이동했음을 보여줍니다.

NVIDIA가 RL 학습 루프를 겨냥했다

NVIDIA가 RL 학습 루프를 겨냥했다

NVIDIA와 Ineffable Intelligence의 협력은 모델 경쟁이 인간 데이터 이후의 RL 인프라 경쟁으로 이동하고 있음을 보여줍니다.

Red Hat이 AI 에이전트의 실행 버튼을 Ansible로 잠갔다

Red Hat이 AI 에이전트의 실행 버튼을 Ansible로 잠갔다

Red Hat Summit 2026 발표는 AI 에이전트가 인프라를 직접 만지는 시대에 필요한 실행, 관측성, 샌드박스 통제 계층을 보여줍니다.

프런티어 AI 사전심사, 모델 출시의 새 관문이 됐다

프런티어 AI 사전심사, 모델 출시의 새 관문이 됐다

CAISI가 Google DeepMind, Microsoft, xAI와 사전 평가 협력을 넓혔습니다. 모델 출시는 이제 벤치마크 경쟁을 넘어 정부 평가 체계 경쟁으로 이동합니다.

Gemini API Webhooks, AI 에이전트 런타임이 됐다

Gemini API Webhooks, AI 에이전트 런타임이 됐다

Google Gemini API Webhooks는 장기 실행 AI 작업을 폴링 루프에서 이벤트 기반 운영 모델로 옮기는 신호입니다.