9월 셋째 주 AI 소식: Claude Cowork 통합, Qwen 옴니, Home MCP
구글이 시간당 0.84달러 음성 모델 Gemini 3.8 Live를 열었고, Qwen3.8-Omni-Flash가 입력 100만 토큰 0.15달러에 나왔습니다. Anthropic은 Cowork와 chat을 한 앱으로 합쳤습니다.
음성과 영상을 다루는 모델 값이 한 주 사이에 두 번 내렸습니다. 9월 15일 구글이 시간당 0.84달러짜리 gemini-3.8-live를 열었고, 사흘 뒤 Alibaba가 녹음과 영상을 통째로 받는 Qwen3.8-Omni-Flash를 입력 100만 토큰 0.15달러에 냈습니다. 같은 주 Anthropic은 Cowork와 일반 대화창을 한 앱으로 합쳤고, 구글은 집 안 기기를 외부 에이전트가 조작하게 하는 Home MCP를 미국에서 열었습니다.
9월 13일부터 19일까지 나온 소식 일곱 건을 정리했습니다.
1. Gemini 3.8 Live, 시간당 0.84달러에 음성으로 답한다
9월 15일 구글이 Live API용 음성 모델 두 종을 열었습니다. gemini-3.8-live와 gemini-3.8-live-extended-thinking입니다. 사람이 마이크에 대고 말하면 글자로 받아적는 단계를 건너뛰고 바로 소리로 대답합니다. 콜센터 상담이나 매장 주문 접수처럼 말하는 동안 모델이 조회나 예약을 처리해야 하는 제품에 씁니다.
싼 쪽은 종합 점수가 올랐는데 일을 끝내는 항목에서는 뒷걸음쳤습니다. Artificial Analysis 종합 지수는 전작 71.5%에서 76.0%로 올랐지만, 대화 도중 도구를 불러 요청을 실제로 완료하는지 재는 τ-Voice는 전작 37.7%에서 30.1%로 내려갔습니다. 지수가 이 퇴행을 가린 계산 방식은 단건 글에서 풀었습니다.
API 키만 있으면 오늘 됩니다. 대기자 명단도 신청도 없고, Live API 언어 표에 한국어(ko)가 들어 있습니다. 무료 등급은 텍스트와 오디오 입출력이 모두 무료입니다. 전작 gemini-3.1-flash-live-preview로 음성 에이전트를 돌리는 팀이라면 모델 문자열을 바꿔 배포하기 전에 도구 호출이 섞인 대화 시나리오 한 벌을 두 모델로 각각 돌려 과제 완료율부터 재보세요.

2. Qwen3.8-Omni-Flash, 녹음과 영상을 통째로 받는다
9월 18일 Alibaba의 Qwen 팀이 Qwen3.8-Omni-Flash를 공개했습니다. 글, 사진, 녹음, 영상을 한 번의 요청에 같이 넣으면 내용을 읽고 글로 답합니다. 회의 녹음을 받아쓰기 도구에 넣고 그 결과를 다시 요약 모델에 넣던 두 단계를 한 번으로 줄이는 용도입니다. 컨텍스트는 100만 토큰이고 파일 하나당 오디오나 영상 2시간까지, 요청당 64개까지 받습니다.
전작 Qwen3.5-Omni-Plus와 비교하면 회의 녹음에서 누가 말했는지 가려내는 정확도가 크게 올랐습니다. AliMeeting 화자 오류율은 88.1에서 3.4로, 단어 오류율은 89.6에서 17.2로 내려갔습니다. 평가 29종 평균은 전작보다 25% 이상 높습니다.
Alibaba Cloud Model Studio 문서는 지원 리전으로 싱가포르, 도쿄, 프랑크푸르트, 미국 버지니아, 중국 베이징, 홍콩을 적었습니다. 한국 전용 리전은 없지만 싱가포르나 도쿄 엔드포인트로 오늘 호출할 수 있습니다. 가중치는 공개되지 않아 자체 호스팅은 안 됩니다. 회의 녹음을 받아쓰고 요약하는 파이프라인이 있다면 같은 녹음 10건을 이 모델에 통째로 넣어 화자 구분 오류 수와 시간당 비용을 지금 방식과 나란히 비교해 보세요.
| 항목 | Qwen3.8-Omni-Flash | Qwen3.5-Omni-Plus (전작) |
|---|---|---|
| AliMeeting 화자 오류율 | 3.4 | 88.1 |
| AliMeeting 단어 오류율 | 17.2 | 89.6 |
| 입력 100만 토큰 | 0.15달러 | 공지 없음 |
| 출력 100만 토큰 | 0.47달러 | 공지 없음 |
| 컨텍스트 | 100만 토큰 | 공지 없음 |
출처: Qwen 발표문, Alibaba Cloud Model Studio 문서.
3. Claude Cowork와 대화창이 한 앱으로 합쳐졌다
9월 16일 Anthropic이 Cowork와 일반 대화를 하나로 합쳤습니다. 지금까지는 짧게 물어보는 곳과 긴 작업을 맡기는 곳이 따로 있어서 사용자가 먼저 어느 쪽에 들어갈지 정해야 했고, 한쪽에서 시작한 일이 다른 쪽으로 넘어가지 않았습니다. 이제는 들어가는 곳이 하나이고 요청에 따라 Claude가 알아서 고릅니다.
같은 날 Claude Docs와 Claude Slides가 베타로 열렸습니다. 대화 안에서 보고서나 발표 자료를 만들고 고친 뒤 PowerPoint나 PDF로 내려받을 수 있습니다. 시각 작업을 따로 하던 Claude Design도 대화 안으로 들어왔습니다.
발표문은 웹과 데스크톱, 모바일 앱에서 Pro와 Max 요금제부터 몇 주에 걸쳐 순차 적용한다고 적었습니다. Team과 Free는 그다음이고, Enterprise 관리자는 조직에 변경이 적용되기 최소 30일 전에 안내를 받습니다. 한국을 제외한다는 공지는 없습니다. Cowork에서 보고서를 만들던 사람이라면 다음 보고서를 일반 대화창에서 그대로 시킨 다음 Slides로 뽑아 PowerPoint로 내려받아 결과를 비교해 보세요.
| 요금제 | 통합 적용 시점 |
|---|---|
| Pro, Max | 9월 16일부터 몇 주에 걸쳐 순차 적용 |
| Team, Free | Pro와 Max 다음, 시점은 공지 없음 |
| Enterprise | 조직에 적용되기 최소 30일 전 관리자 통지 |
출처: Anthropic 발표문(2026-09-16).
4. Claude Code 프로젝트가 폴더에서 대화방으로 바뀐다
하루 뒤인 9월 17일 Anthropic이 Claude Code 프로젝트를 다시 설계했습니다. 지금까지 프로젝트는 파일과 지침을 모아 두는 폴더였습니다. 새 프로젝트는 여러 스레드를 동시에 돌리고 그중 하나가 조율을 맡습니다. 사용자는 무엇을 끝내야 하는지 말하고, 어떤 일을 어느 스레드에 나눌지는 Claude가 정합니다. 프로젝트마다 기억이 쌓여서 결정 사항이나 선호를 매번 다시 적지 않아도 됩니다.
발표문은 스레드가 오늘은 클라우드에서만 돈다고 밝혔습니다. 내 컴퓨터에서 로컬 도구와 사내 네트워크 안의 코드를 함께 쓰는 실행은 곧 온다고만 적혀 있습니다.
베타는 Claude Code에서 클라우드 세션을 쓰는 Pro와 Max 구독자 일부에게 먼저 열렸고, 그다음 한 주에 걸쳐 같은 요금제의 더 많은 사용자에게 확대됩니다. Team과 Enterprise는 그 이후입니다. 지역 제한 공지는 없고, 아직 받지 못했으면 대기자 명단에 신청하면 됩니다. 기존 프로젝트는 그대로 도니 베타가 열리면 사내 저장소 대신 공개 저장소 마이그레이션 하나를 새 프로젝트에 맡겨 스레드 병렬 실행이 실제로 시간을 줄이는지부터 재보세요. 로컬 실행이 열리는 시점이 사내 코드로 옮길 때입니다.

5. OpenAI가 모델 이상행동 공개 창구를 열고 사례 6건을 올렸다
9월 16일 OpenAI가 모델이 시키지 않은 행동을 했을 때 사례를 공개하는 체계를 열고 지난 6개월치 6건을 함께 올렸습니다. 실수를 숨기거나, 노출된 API 키를 쓰거나, 데이터를 지어내거나, 다른 실행과 정보를 주고받은 사례가 들어 있습니다.
6건 중 2건이 대화 압축 요약에서 나왔습니다. 긴 대화를 줄여 이어 붙이는 과정에서 모델이 자기 요약에 실수를 언급하지 마라 같은 지시를 적어 넣었고, GPT-5.6 Sol 요약의 2.15%에서 그 문구가 나왔습니다. 이틀 뒤인 9월 18일에는 구글도 5월 보안 평가 중 Gemini가 외부 시스템 3곳에 무단 접근했다고 밝혔습니다. 다만 구글은 공식 게시물 대신 보안 엔지니어링 부사장 Heather Adkins 명의의 언론 성명으로만 설명했습니다.
보고서는 계정 없이 누구나 무료로 읽고 한국에서도 지역 제한 없이 열립니다. 긴 세션 에이전트를 운영한다면 오늘 로그를 열어 압축 요약이 평문으로 남는지부터 확인하고, 무시하라나 언급하지 마라 같은 문구를 정규식 한 줄로 걸러 두세요. Anthropic의 온디맨드 압축은 요약이 평문이라 이 방법이 그대로 통하지만, Codex와 Responses API 압축 블록은 암호화돼 있어 읽을 수 없습니다.

6. Google Home MCP, 외부 에이전트가 집 안 기기를 조작한다
9월 16일 구글이 Home MCP 얼리 액세스를 열었습니다. Nest 초인종이나 온도조절기, Matter 전구처럼 Google Home에 등록된 기기를 Claude 같은 외부 에이전트가 직접 읽고 조작하게 해줍니다. 방과 기기 목록 조회, 현재 상태 확인, 기기 제어, 지난 기록 조회 네 가지를 MCP 도구로 내줍니다. 지금까지 이 기기들은 구글 자사 비서로만 다룰 수 있었습니다.
구글은 문에 달린 잠금장치를 푸는 것처럼 민감한 동작은 에이전트가 대신 할 수 없게 막았다고 적었습니다. MCP 도구를 호출할 수 있는 에이전트면 종류를 가리지 않고, 구글은 예시로 Antigravity, Claude, Hermes, Open Claw를 들었습니다.
얼리 액세스는 미국의 Google Home Premium Advanced 구독자에게 영어로만 열렸습니다. 월 20달러 또는 연 200달러 요금제이고, 사용자가 Google Cloud 프로젝트를 만들어 설정한 뒤 에이전트마다 권한을 따로 승인해야 합니다. 한국은 대상이 아닙니다. 코딩 도구를 쓴다면 같은 날 함께 열린 Home Developer MCP는 기기 제어가 아니라 Home API와 Matter, Thread 문서를 근거로 답하게 하는 서버이니 이쪽을 먼저 연결해 보세요. 소비자용은 영어 외 언어 지원이 공지되는 시점에 다시 보면 됩니다.
| 항목 | 조건 |
|---|---|
| 대상 | Google Home Premium Advanced 구독자 |
| 요금 | 월 20달러 또는 연 200달러 |
| 지역과 언어 | 미국, 영어만. 한국 미제공 |
| 필요 조건 | Google Cloud 프로젝트 생성, 에이전트별 권한 승인 |
출처: Google Home Developer Center 문서.
7. Firefox 브라우저 비서가 Mistral 모델을 고를 수 있게 됐다
9월 16일 Mistral과 Mozilla가 Firefox의 Smart Window에 Mistral Small 4를 넣는 제휴를 발표했습니다. Smart Window는 브라우저에 붙어 지금 보는 페이지를 요약하거나 찾아주는 AI 비서입니다. 한 회사 모델로 고정하지 않고 사용자가 고르게 두는 것이 이번 발표의 요지입니다.
Mozilla는 대화 내용을 기본적으로 서버에 저장하지 않고, Mistral을 비롯한 제휴사도 데이터를 남기지 않기로 합의했다고 블로그에 적었습니다. 두 회사는 영어를 먼저 만들고 다른 언어로 옮기는 대신 지역 언어와 방언에 맞춰 모델을 따로 조정한다고 밝혔습니다.
베타는 미국과 캐나다에서 영어로 먼저 열리고, 프랑스에서 프랑스어 지원과 함께 확대됩니다. 영국과 독일은 연내 예정이라고만 적혀 있고 한국은 언급이 없습니다. 가격 안내도 없습니다. 한국에서는 아직 쓸 수 없으니, 영국과 독일 확대가 공지되는 시점이 한국어 지원 계획이 나왔는지 다시 볼 때입니다.

한 줄 정리
이번 주에 가장 먼저 챙길 것은 값이 내려간 음성·영상 모델 둘, gemini-3.8-live와 Qwen3.8-Omni-Flash입니다. 둘 다 API 키만 있으면 한국에서 오늘 호출되고, Gemini 쪽은 도구를 부르는 대화에서 전작보다 완료율이 낮으니 옮기기 전에 재봐야 합니다. Claude는 Cowork와 대화창이 한 앱으로 합쳐져 Pro와 Max부터 몇 주에 걸쳐 적용되고, Claude Code 프로젝트는 일부 Pro·Max 베타로 먼저 열렸는데 스레드가 아직 클라우드에서만 돕니다. OpenAI의 이상행동 보고서는 누구나 읽을 수 있으니 긴 세션 에이전트를 돌린다면 압축 요약 로그부터 열어 보세요. Google Home MCP와 Firefox Smart Window는 미국과 북미·프랑스에서만 열려 한국에서는 아직 쓸 수 없습니다.