Devlery

Blog

AI 뉴스와 코딩 에이전트, LLM, AI 인프라의 변화를 기록합니다.

Arm Metis 공개, SAST 오탐 50% 감소를 겨냥한 보안 에이전트

Arm Metis 공개, SAST 오탐 50% 감소를 겨냥한 보안 에이전트

Arm이 Metis를 오픈소스로 공개했습니다. 130개 내부 프로젝트, RAG 보안 리뷰, SARIF triage, 오탐 비용의 변화를 짚습니다.

LFM2.5 8B 공개, 노트북 에이전트의 도구 호출 경쟁

LFM2.5 8B 공개, 노트북 에이전트의 도구 호출 경쟁

Liquid AI가 LFM2.5-8B-A1B를 공개했습니다. 1.5B active MoE, 128K 컨텍스트, 로컬 도구 호출의 가능성과 라이선스 제한을 봅니다.

CAPTCHA 통과한 AI, 0.88 AUC가 잡은 풀이 과정

CAPTCHA 통과한 AI, 0.88 AUC가 잡은 풀이 과정

Roundtable과 arXiv 논문은 AI 에이전트가 CAPTCHA 정답을 맞혀도 클릭 순서와 행동 과정에서 구분된다고 주장합니다.

Claroty Claire 출시, 공장·병원 에이전트 보안의 승인선

Claroty Claire 출시, 공장·병원 에이전트 보안의 승인선

Claroty가 CPS-native AI 보안 에이전트 Claire를 공개했습니다. 공장·병원 환경에서 AI 조치가 왜 데이터, 승인, 감사와 묶여야 하는지 봅니다.

Reactor 5900만 달러 투자, 실시간 AI 세계의 API 경쟁

Reactor 5900만 달러 투자, 실시간 AI 세계의 API 경쟁

Reactor는 실시간 월드 모델을 SDK와 API로 제공하려는 인프라 회사로 출범하며 AI 비디오의 병목을 지연시간과 세션 운영으로 옮겼습니다.

Kog 3000토큰/s 공개, 코딩 에이전트 병목은 지연시간

Kog 3000토큰/s 공개, 코딩 에이전트 병목은 지연시간

Kog KIE tech preview는 8× MI300X에서 3000토큰/s를 주장했습니다. 2B 모델 조건과 에이전트 지연시간의 의미를 짚습니다.

Antigravity 93개 에이전트, 1000달러 OS 실험의 비용표

Antigravity 93개 에이전트, 1000달러 OS 실험의 비용표

Google Antigravity teamwork-preview는 93개 subagent와 2.6B 토큰으로 OS 데모를 만들었습니다. 숫자와 한계를 짚습니다.

LLM 5종이 팩트체크 67%에서 갈렸다, AI 검색의 검증 비용

LLM 5종이 팩트체크 67%에서 갈렸다, AI 검색의 검증 비용

Lenz Research의 1,000건 실험은 frontier LLM 5종이 실제 팩트체크 claim의 67%에서 같은 판정을 못 냈다고 보고했습니다.

AI 코딩 45% 매일 배포, DevOps 병목이 남긴 청구서

AI 코딩 45% 매일 배포, DevOps 병목이 남긴 청구서

Harness 2026 보고서는 AI 코딩 잦은 팀의 배포 속도, 장애, 보안·번아웃 지표를 함께 보여줍니다.

Claude 10만 명과 Codex 도입, Fujitsu가 바꾸는 SI

Claude 10만 명과 Codex 도입, Fujitsu가 바꾸는 SI

Fujitsu가 OpenAI와 Anthropic 협업을 같은 날 발표했습니다. Claude 10만 명 배포, Codex 도입, FDE 모델 변화를 짚습니다.

o3 8월 26일 종료, Canvas 빠진 ChatGPT 모델 정리

o3 8월 26일 종료, Canvas 빠진 ChatGPT 모델 정리

OpenAI가 GPT-5.5 Instant 업데이트와 함께 Canvas 제거, o3·GPT-4.5 ChatGPT 종료 일정을 공지했습니다. API는 유지됩니다.

OpenJarvis 1.0, 개인 AI가 Ollama PC로 들어온 날

OpenJarvis 1.0, 개인 AI가 Ollama PC로 들어온 날

Ollama가 OpenJarvis v1.0 지원을 공개했습니다. 로컬 개인 AI가 비용, 지연 시간, 데이터 경계를 어떻게 다시 계산하는지 봅니다.