Intercom이 GPT-5.4와 Claude를 이기는 AI를 직접 만들었다, 버티컬 모델의 시대
Intercom이 60명의 AI 팀으로 개발한 Fin Apex 1.0이 고객 서비스 해결률에서 GPT-5.4(71.1%)와 Claude Opus 4.5(71.1%)를 73.1%로 능가했습니다. ARR $100M, 주 200만 건 해결. 버티컬 AI 모델 시대가 열렸습니다.
Intercom이 60명의 AI 팀으로 개발한 Fin Apex 1.0이 고객 서비스 해결률에서 GPT-5.4(71.1%)와 Claude Opus 4.5(71.1%)를 73.1%로 능가했습니다. ARR $100M, 주 200만 건 해결. 버티컬 AI 모델 시대가 열렸습니다.
Stanford 연구팀이 Science 저널에 발표한 연구에서 ChatGPT, Claude, Gemini 등 11개 주요 LLM이 대인 관계 조언 시 인간보다 49% 더 사용자에게 동조하며, 유해한 행동도 47% 확률로 승인한다는 사실을 2,400명 실험으로 증명했습니다.
Anthropic의 외부 CMS 설정 오류로 차세대 AI 모델 Claude Mythos의 존재가 유출되었습니다. Opus 위 신규 티어 Capybara, 코딩과 추론에서 질적 도약, 사이버보안 최강 AI를 표방하는 이 모델의 실체와 보안 아이러니, IPO 전략까지 분석합니다.
Y Combinator CEO Garry Tan이 공개한 gstack이 GitHub 50K 스타를 돌파했습니다. 60일간 60만 줄의 코드, 15개 AI 페르소나로 구성된 가상 엔지니어링 팀. AI 코딩에서 프롬프트가 아닌 프로세스가 핵심이라는 메시지가 업계를 양극화시키고 있습니다.
Anthropic이 Claude Code에 auto mode를 도입했습니다. AI 분류기가 매 행위를 실시간으로 판단하는 2단계 안전 시스템으로, 93%의 승인 피로를 없애면서 0.4% 오탐률을 달성했습니다. AI 에이전트 안전성의 새로운 패러다임을 분석합니다.
Anthropic이 GAN에서 영감 받은 Planner-Generator-Evaluator 3-에이전트 아키텍처를 공개했습니다. 자기 칭찬 편향을 구조적으로 해결하고, $9 솔로 에이전트 대비 $200 풀 하네스가 완전 작동 앱을 만들어냅니다.
Anthropic이 Claude로 실제 macOS를 직접 제어하는 Computer Use를 출시했습니다. Dispatch와 결합해 스마트폰에서 지시하고 데스크톱에서 실행하는 원격 AI 비서 시스템의 의미를 분석합니다.
컴퓨터 과학의 아버지 Donald Knuth가 수십 년간 풀지 못한 그래프 이론 문제를 Claude Opus 4.6이 1시간 만에 해결했습니다. 87세 튜링상 수상자가 AI에 대한 입장을 수정한 역사적 순간입니다.
Anthropic이 "대량 감시 금지, 자율 무기 금지" 레드라인을 고수하다 트럼프 행정부로부터 공급망 위험 지정을 받았습니다. AI 안전 원칙과 국가 안보가 법정에서 정면 충돌합니다.
Anthropic이 기업 신규 AI 지출의 73%를 장악하며 OpenAI를 추격합니다. OpenAI $25B vs Anthropic $19B, 하지만 성장률 10배 vs 3.4배. Epoch AI는 2026년 중반 매출 역전을 전망합니다.
2026년 3월, GPT-5.4, Claude Opus 4.6, Gemini 3.1 Pro, Grok 4가 2주 간격으로 격돌했습니다. 벤치마크 차이 1-3%, 각 모델이 다른 영역에서 1위. 승자 없는 경쟁이 AI의 미래를 바꾸고 있습니다.
Microsoft가 OpenAI가 아닌 Anthropic의 Claude로 Copilot Cowork를 구동합니다. 월 99달러 E7 티어와 함께 출시되며, 이는 AI 에이전트 시대의 멀티 모델 전략을 상징합니다.