Blog
AI 뉴스와 코딩 에이전트, LLM, AI 인프라의 변화를 기록합니다.
ADK Go 2.0 GA, 사람 승인까지 품은 그래프 워크플로
Google이 ADK Go 2.0을 GA로 공개했습니다. 그래프 워크플로, 사람 승인, 동적 오케스트레이션은 에이전트 실행을 LLM 루프 밖으로 옮깁니다.
Fable 5 복귀, 99% 차단 뒤에 붙은 탈옥 점수표
Anthropic이 Fable 5 접근을 복구했습니다. 99% 차단 분류기, 4가지 탈옥 심각도 기준, HackerOne 접수가 새 조건입니다.
Claude Sonnet 5 공개, Opus급 에이전트 성능의 가격 인하
Anthropic이 Claude Sonnet 5를 공개했습니다. 낮은 API 가격, effort 조절, GitHub Copilot 배포가 코딩 에이전트 비용 계산을 바꿉니다.
Gemini API 키 차단 시작, Interactions GA와 9월 표준 키 종료
Google이 Interactions API를 Gemini 기본 인터페이스로 올리고 표준 API 키 종료 일정을 못박았습니다. 기존 앱은 9월 전에 인증 키와 호출 방식을 점검해야 합니다.
Claude Science 베타, 연구실 터미널에 붙은 60개 스킬
Anthropic이 Claude Science 베타를 공개했습니다. 60개 이상 과학 스킬, HPC 접근, 리뷰어 에이전트, BioNeMo 통합을 묶은 연구 워크벤치입니다.
Qwen-AgentWorld 공개, 실행 전에 결과를 보는 에이전트 실험
Qwen이 35B 공개 가중치와 AgentWorldBench를 내놓았습니다. 에이전트가 도구를 호출하기 전에 다음 환경을 예측하는 실험입니다.
vLLM Micro-Agent 공개, 모델 API 안으로 들어간 라우터 루프
vLLM Semantic Router가 Micro-Agent를 공개했습니다. OpenAI 호환 API 뒤에서 라우터가 비용·품질·관측성을 제어하는 방식입니다.
Sakana Fugu Ultra 공개, 73.7점 SWE-Bench Pro와 단일 요금
Sakana Fugu Ultra는 여러 프런티어 모델과 전문 에이전트를 한 API로 묶습니다. 벤치마크, 가격, 라우팅 비공개 조건을 함께 봅니다.
MCP 기업 권한 안정화, 에이전트 도구 연결을 SSO로
MCP Enterprise-Managed Authorization이 안정화됐습니다. Claude와 Okta 채택, MCP 인증 취약성 연구가 말하는 기업 에이전트 권한 경계를 짚습니다.
Gemini 컴퓨터 사용 공개, 브라우저 에이전트에 안전판 추가
Google이 Gemini 3.5 Flash에 화면 조작형 Computer Use 공개 프리뷰를 추가했습니다. 개발팀이 봐야 할 실행 루프와 안전 경계를 정리합니다.
에이전트 흔적 1,781개 분석, 모델보다 7배 큰 하네스 효과
Braintrust와 Hugging Face가 공개 에이전트 흔적 1,781개를 분석했습니다. 성공률과 비용은 모델명보다 하네스와 작업 유형에 더 민감했습니다.
Hugging Face 주간 릴리스, AI 초안과 검증 코드의 분업
huggingface_hub가 4~6주 릴리스를 주간 주기로 바꿨습니다. 오픈 웨이트 모델, PR 검증, 사람 승인 구조를 짚습니다.