DeepSeek V4 Flash 0731, Codex 공식 연동에 출력 100만 토큰 0.28달러
DeepSeek가 7월 31일 V4-Flash API를 공개 베타로 전환했습니다. Responses API를 네이티브 지원하고, Codex 설정 파일 작성법을 공식 문서로 냈습니다.
DeepSeek가 7월 31일 V4-Flash API를 공개 베타로 전환했습니다. Responses API를 네이티브 지원하고, Codex 설정 파일 작성법을 공식 문서로 냈습니다.
Alibaba가 2.4조 파라미터 Qwen3.8-Max-Preview를 공개했습니다. 벤치마크 표, 모델 카드, 라이선스, 활성 파라미터, 토큰당 요금이 모두 빠진 자리에 90%와 98% 할인 캠페인이 먼저 들어왔습니다.
Moonshot AI가 2.8조 파라미터 Kimi K3를 공개했습니다. 독립 평가 3위에 올랐지만 출력 토큰값은 3.75배 뛰었고, 가중치 배포는 아직 시작되지 않았습니다.
OpenRouter를 지나는 미국 트래픽에서 중국산 오픈웨이트 모델 토큰 비중이 46%까지 올랐다. 60에서 90% 싼 가격과 라우팅 전략이 만든 이동, 그리고 남은 데이터법 리스크를 짚는다.
Qwen이 35B 공개 가중치와 AgentWorldBench를 내놓았습니다. 에이전트가 도구를 호출하기 전에 다음 환경을 예측하는 실험입니다.
MiniMax M3는 100만 토큰 context, agentic coding, 오픈 웨이트 예고를 내세웁니다. API와 검증 과제를 분리해 봅니다.
MiniMax M3는 1M 컨텍스트, 멀티모달, 코딩 에이전트 벤치마크를 묶었지만 weights와 리포트는 아직 검증 대상입니다.
Reasonix 논쟁은 코딩 에이전트 비용이 모델 가격뿐 아니라 prefix cache를 깨지 않는 하네스 설계에 달렸음을 보여줍니다.
DeepSeek V4-Pro의 75% 할인 가격이 정가가 됩니다. 에이전트 추론비와 모델 라우팅 전략을 다시 계산해야 할 신호입니다.
Alibaba Qwen3.7-Max는 모델 발표를 넘어 자체 칩과 128가속기 랙까지 묶은 에이전트 풀스택 전략입니다.
Baidu가 Daily Active Agents를 AI 시대 핵심 지표로 제안했습니다. 토큰 비용이 아니라 결과를 내는 에이전트 수를 보자는 주장입니다.
중국의 AI 에이전트 시행 의견은 챗봇 규제를 넘어 등록, 신원, 상호운용, 권한, 추적을 갖춘 지능 인터넷 구상으로 이동합니다.