Blog
AI 뉴스와 코딩 에이전트, LLM, AI 인프라의 변화를 기록합니다.
62만번 공격이 가른 모델 안전, 추론형의 35점 격차
TELUS Digital이 34개 AI 모델을 62만번 이상 공격한 안전 벤치마크를 공개했습니다. 추론형 모델, 작은 모델, 지속 테스트의 차이를 짚습니다.
90% PR을 에이전트가 만든다, Warp 오픈소스의 새 병목
OpenAI와 Warp 사례는 코딩 에이전트 경쟁이 코드 생성에서 오픈소스 검증, 관측성, 에이전트 오케스트레이션으로 옮겨감을 보여줍니다.
2나노 칩렛으로 간 토큰 공장, Furiosa와 Broadcom의 우회로
FuriosaAI와 Broadcom의 3세대 추론 칩 협력은 에이전트 시대 병목이 GPU 밖의 토큰 밀도와 네트워크로 이동했음을 보여줍니다.
API 없는 앱까지 누른다, Copilot Studio GA의 자동화 경계
Microsoft Copilot Studio computer use GA는 UI 자동화 에이전트를 실험에서 기업 배포와 감사 로그의 문제로 옮깁니다.
한 번 호출하면 리눅스가 뜬다, Gemini 에이전트 API의 선
Google Managed Agents는 Gemini API를 모델 호출에서 샌드박스 실행 API로 넓히며 에이전트 운영층의 경계를 바꿉니다.
7천건 세금신고가 만든 루프, Codex 자기개선의 조건
OpenAI Tax AI 사례는 에이전트 자동화보다 프로덕션 트레이스, 평가 세트, 실무자 피드백이 더 중요하다는 신호입니다.
받은편지함부터 DCF까지, Codex가 코딩 밖으로 간 이유
Codex use cases가 inbox, 데이터, 재무, QA, 앱 자동화까지 확장됐습니다. 코딩 에이전트가 업무 운영층으로 이동하는 신호입니다.
에이전트 기억이 파일로 내려왔다, AMP 초안과 OpenAI의 다른 길
OpenAI Agents SDK memory와 AMP v0.1 초안은 에이전트 장기 기억을 파일, Git, MCP, 감사 가능한 상태의 문제로 바꿉니다.
3.5배 Claude 사용량, Anthropic이 서울로 온 이유
Anthropic이 한국 대표를 선임하고 서울 오피스를 예고했습니다. 3.5배 Claude 사용량이 말하는 한국 AI 시장의 신호를 짚습니다.
CLAUDE.md가 공격 표면이 됐다, TrapDoor의 보이지 않는 지시
TrapDoor는 npm, PyPI, Crates.io 악성 패키지에 AI 코딩 지시 파일 오염을 결합한 새 공급망 공격입니다.
SDK 공장이 Claude로 간다, MCP 표준의 숨은 권력
Anthropic의 Stainless 인수는 Claude가 SDK와 MCP 서버 생성층까지 끌어안으며 에이전트 연결 경쟁이 도구 체인으로 내려갔음을 보여줍니다.
앱이 MCP 서버가 된다, 안드로이드 에이전트의 새 입구
Google의 Android AI 업데이트는 앱을 Gemini와 에이전트가 호출할 온디바이스 도구 표면으로 바꾸는 신호입니다.