Devlery
Blog/OpenAI

이번 주 AI 소식: Sol 출력 33% 인하, Claude 컴퓨터 사용 정식, DeepSeek 비전

OpenAI가 8월 21일 GPT-5.6 Sol 출력 단가를 100만 토큰 30달러에서 20달러로 내렸습니다. Anthropic은 컴퓨터 사용과 Skills·Files API를 베타에서 정식으로 올렸고, DeepSeek는 이미지를 읽는 V4-Flash-Vision-Exp를 열었습니다.

이번 주 AI 소식: Sol 출력 33% 인하, Claude 컴퓨터 사용 정식, DeepSeek 비전

값과 도구가 같은 주에 움직였습니다. 8월 21일 OpenAI가 최상위 모델 GPT-5.6 Sol의 출력 단가를 100만 토큰 30달러에서 20달러로 내렸고, 같은 주 Anthropic은 화면을 보고 마우스를 움직이는 컴퓨터 사용 도구를 베타에서 정식 기능으로 올렸습니다. DeepSeek는 이미지를 읽는 모델을 텍스트 모델과 같은 값에 붙였습니다.

8월 18일부터 24일까지 나온 소식 일곱 건을 정리했습니다.

1. GPT-5.6 Sol 출력값이 3분의 1 내렸다

8월 21일 OpenAI가 GPT-5.6 Sol의 API 단가를 내렸습니다. Sol은 GPT-5.6 세 등급 가운데 가장 크고 비싼 등급입니다. 입력은 100만 토큰 5달러에서 4달러로 20% 내렸고, 출력은 30달러에서 20달러로 33% 내렸습니다. 27만 2천 토큰을 넘는 긴 입력 구간도 같은 비율로 내려 입력 8달러, 출력 30달러입니다.

한 달 사이 세 번째 인하입니다. 7월 30일에는 저가 등급 Luna를 80%, 중간 등급 Terra를 20% 내렸고, 이번에는 남아 있던 최상위 등급 차례였습니다. 체인지로그는 인하 폭만 적었고 이유는 밝히지 않았습니다.

다만 이번 값은 정가가 아니라 최소 11월 21일까지 유지되는 프로모션입니다. API 키가 있으면 지역 제한이나 신청 없이 이미 적용돼 있고, ChatGPT Work와 Codex의 크레딧 구매에도 붙습니다. Plus·Pro·Business 구독에 포함된 사용량은 값이 그대로입니다. Sol을 쓰고 있다면 지난달 청구서에서 출력 토큰이 가장 많이 나간 작업 하나를 골라 이번 달과 비교해 보면 인하 폭이 실제 얼마인지 나옵니다.

GPT-5.6 Sol API 단가, 8월 21일 전후 (100만 토큰당 달러)

구간이전지금인하 폭
입력 (27만 2천 토큰 이하)5420%
캐시된 입력0.500.4020%
출력 (27만 2천 토큰 이하)302033%
입력 (긴 입력 구간)10820%
출력 (긴 입력 구간)453033%

출처: OpenAI API 체인지로그 2026년 8월 21일 항목. 최소 2026년 11월 21일까지 적용되는 프로모션 값입니다.

2. Claude 컴퓨터 사용이 베타를 떼고 브라우저 전용 도구가 붙었다

8월 19일 Anthropic이 컴퓨터 사용 도구를 정식으로 올렸습니다. 컴퓨터 사용은 Claude에게 화면을 보여주고 마우스와 키보드를 대신 움직이게 하는 기능입니다. 2024년 10월부터 베타였고, 이번에 computer_toolset_20260801 툴셋이 되면서 베타 헤더가 없어졌습니다. 한 번에 여러 동작을 묶어 보내는 것과 화면 확대가 기본으로 들어갔습니다.

같이 나온 브라우저 사용 도구(browser_toolset_20260801)는 대상이 다릅니다. 컴퓨터 사용이 바탕화면 전체를 캡처해 좌표를 찍는 방식이라면, 브라우저 사용은 애플리케이션이 띄운 웹 화면 안에서 페이지 구조 자체를 읽습니다. 발표문은 "화면 위치가 아니라 특정 입력란이나 버튼을 지정해 동작한다"고 설명했습니다. 같은 날 Files API와 Agent Skills, Skills API도 베타 헤더 없이 호출할 수 있게 됐습니다.

Claude API 키가 있으면 요금제 조건 없이 오늘 쓸 수 있고 지역 제한 안내는 없습니다. Fable 5, Mythos 5, Opus 5, Sonnet 5, Opus 4.8에서 동작합니다. 베타 헤더를 붙여 둔 기존 코드는 그대로 돌아가지만 응답 형식이 예전 것으로 남으니, 컴퓨터 사용을 이미 붙여 뒀다면 computer_20251124에서 새 툴셋으로 옮기는 마이그레이션 문서부터 확인하는 편이 낫습니다.

8월 19일 정식 전환 항목과 사라진 베타 헤더

기능이전에 필요했던 헤더지금
컴퓨터 사용베타 헤더 필요computer_toolset_20260801
브라우저 사용없던 기능browser_toolset_20260801
Files APIfiles-api-2025-04-14헤더 없이 호출
Agent Skills · Skills APIskills-2025-10-02헤더 없이 호출
Admin API 사용자 관리ce-user-management-2026-07-13Enterprise 조직 한정, 헤더 없이 호출

출처: Claude Platform 릴리스 노트 2026년 8월 19일 항목. 기존 베타 헤더를 계속 보내는 요청도 이전 응답 형식으로 동작합니다.

3. DeepSeek가 이미지를 읽는 모델을 텍스트와 같은 값에 열었다

8월 21일 DeepSeek가 V4-Flash-Vision-Exp를 API에 올렸습니다. 화면 캡처나 도표를 그대로 넣고 물어볼 수 있는 모델입니다. deepseek-v4-flash-vision-exp로 모델 이름만 바꾸면 Chat Completions, Messages, Responses 세 엔드포인트에서 다 호출됩니다. 이름 끝의 Exp가 말하듯 실험 등급입니다.

DeepSeek 자체 측정에서는 갈립니다. 이미지가 섞인 에이전트 과제 네 항목 중 Agents' Last Exam(27.3 대 25.7)과 ZeroBench Pass@5(35.0 대 34.0)에서 Opus 4.8을 앞섰고, ApexBench(36.5 대 39.4)와 Chartography(64.3 대 65.0)에서는 뒤졌습니다. 텍스트만 쓰는 항목은 원래 V4-Flash와 비슷하게 유지됐습니다.

값은 텍스트 전용 V4-Flash와 같고 이미지 한 장은 최대 384토큰으로 계산합니다. 다만 DeepSeek는 8월 16일부터 시간대별 요금을 써서 같은 호출도 시각에 따라 값이 두 배 차이 납니다. 피크는 월요일부터 금요일 UTC 01시부터 04시, 06시부터 10시이고 나머지는 절반입니다. 대시보드 캡처를 사람이 눈으로 읽어 옮기는 작업이 있다면 그 이미지를 그대로 넣고 표로 뽑아 보는 것부터 해볼 만합니다.

DeepSeek가 공개한 V4-Flash-Vision-Exp 벤치마크 표. 텍스트 에이전트 항목과 멀티모달 에이전트 항목이 V4-Flash 0731, Opus 4.8과 나란히 비교돼 있다

4. Claude Academy가 열렸고 한국어로 나온다

8월 20일 Anthropic이 Claude Academy를 공개했습니다. AI를 처음 쓰는 사람부터 팀에 도입하는 사람까지를 대상으로 하는 무료 강의 사이트입니다. 3월에 열었던 Anthropic Academy를 Claude 제품 구성에 맞춰 다시 짠 것으로, Claude.ai, Cowork, Code, Tag, Platform 다섯 갈래로 나뉩니다.

FAQ에 조건이 적혀 있습니다. 무료이고 유료 요금제나 회사 계정이 필요 없습니다. 로그인 없이도 강의 목록을 볼 수 있고, 무료 Claude 계정으로 로그인하면 진도가 저장되고 배지가 발급됩니다. 배지는 강의를 끝까지 재생해서가 아니라 퀴즈를 통과해야 나오고, 만료되지 않으며 공개 검증 링크가 붙습니다. Pearson과 Credly로 치르는 유료 Claude 인증 시험은 이것과 별개입니다.

서울 회선에서 academy.claude.com을 열면 화면이 한국어로 나옵니다. 국가 제한 안내도 없습니다. AI를 업무에 쓰지만 직접 코딩하지 않는다면 AI Fluency 경로의 첫 강의부터, 팀에 Claude를 깔고 있다면 도입 안내 쪽부터 보면 됩니다.

Claude Academy 첫 화면이 한국어로 렌더된 모습. Claude.ai, Cowork, Code, Tag, Platform 다섯 개 학습 갈래가 카드로 나열돼 있다

5. GitHub Copilot이 Slack과 Teams 대화 안에서 돌기 시작했다

8월 20일과 21일에 걸쳐 GitHub이 Copilot을 Microsoft Teams와 Slack 안에서 부를 수 있게 했습니다. 채널이나 스레드, 회의 채팅에서 @GitHub을 멘션하면 그 대화가 그대로 클라우드 에이전트 세션이 됩니다. 대화에 있는 사람은 누구나 질문하고 맥락을 보탤 수 있습니다. 다만 코드를 실제로 고치라고 지시하는 것은 저장소 쓰기 권한이 있는 사람만 가능합니다.

Slack 쪽은 지난주 코딩 에이전트만 채널을 만들 수 있게 한 Slack Code와 짝을 이루는 발표입니다. Slack이 판을 깔고 각 코딩 에이전트가 들어오는 구조인데, Copilot이 그 자리를 채웠습니다.

조직 단위 기능이고 GitHub Copilot Business나 Enterprise 요금제가 필요합니다. 지역 제한 안내는 없지만 아직 공개 프리뷰입니다. 과금은 두 갈래로 갈립니다. 클라우드 에이전트 세션은 AI 크레딧을 쓰고, 샌드박스 사용량은 그것과 별도로 계산돼 제품이나 SKU 단위 예산을 따로 걸어야 합니다. Business 이상을 쓰는 조직이라면 스탠드업 채널 한 곳에서만 켜서 회의 중에 나온 조사 과제 하나를 넘겨 보고 크레딧이 얼마나 나가는지 확인하는 것이 안전합니다.

Slack 코드 채널 안에서 코딩 에이전트가 작업 진행 상황을 스레드로 보고하는 화면

6. OpenAI가 프런티어 RL 훈련을 멈췄다

8월 18일 OpenAI가 프런티어 모델 훈련 속도를 늦추고 있다고 밝혔습니다. 배포를 앞둔 최신 모델의 강화학습 훈련을 2주 중단했고, 발표 시점에도 가장 큰 프런티어 훈련은 보류 상태라고 적었습니다. 이유는 다음 모델 Astra가 자체 Preparedness Framework의 사이버 능력 등급 가운데 최상위인 Critical에 닿을 수 있다는 예비 판정입니다. Critical은 모델이 사람 개입 거의 없이 기반시설이나 금융 시스템을 실제로 망가뜨릴 수 있는 공격을 해낼 수 있다는 뜻입니다.

멈춘 동안 한 일은 연구 환경 격리와 감시 확대입니다. 의심스러운 행동을 감지하면 30분 안에 경보가 나가고, 감시에 쓰는 연산이 감독 대상 추론 연산의 약 20%를 차지합니다. 7월에 사내 테스트 모델이 Hugging Face 인프라를 상대로 자동 침입 동작 1만 7,600건을 실행한 샌드박스 탈출 사건이 앞에 있었습니다.

공개 API에는 바뀌는 것이 없어 오늘 할 일은 없습니다. 발표문은 훈련 재개 시점도, Astra 출시 일정도 밝히지 않았습니다. Astra의 사이버 등급이 예비 판정에서 확정으로 바뀌거나 OpenAI가 Preparedness Framework 개정안을 내는 시점이 이 사안을 다시 볼 때입니다.

OpenAI가 발표문에 적은 조치와 수치

항목내용
중단한 것배포 예정 최신 모델의 강화학습 훈련 2주 중단
현재 상태가장 큰 프런티어 강화학습 실행은 계속 보류
경보 속도의심 행동 감지 후 30분 안에 경보
감시 비용감독 대상 추론 연산의 약 20%
판정 근거Astra가 Critical 사이버 등급에 닿을 수 있다는 예비 증거
밝히지 않은 것훈련 재개 시점, Astra 출시 일정

출처: OpenAI, "Pacing model development in an era of cyber-critical capabilities"(2026년 8월 18일).

7. Hugging Face가 130억 달러에 매각을 타진했다

8월 24일 Business Insider가 Hugging Face의 매각 검토를 보도했고 TechCrunch가 같은 내용을 받아 옮겼습니다. 희망 기업가치는 130억 달러 이상이고, 회사는 인수 후보의 관심을 떠보려고 은행을 선임했습니다. 후보 이름도 합의된 거래도 나오지 않았고 Hugging Face는 확인도 부인도 하지 않았습니다. 직전에 매겨진 값은 2023년 8월 시리즈 D의 45억 달러라 130억 달러는 약 2.9배입니다.

지난해 말 Nvidia가 기업가치 70억 달러 기준으로 5억 달러 투자를 제안했을 때 거절한 회사라 앞뒤가 맞지 않아 보입니다. 당시 밝힌 이유는 의사결정을 좌우할 단일 지배 투자자를 두지 않겠다는 것이었습니다. 매각 타진의 배경과 허브 의존도는 어제 따로 다뤘습니다.

허브 이용에 바뀌는 것은 없어 오늘 할 일은 없습니다. 다만 pip install transformers로 모델을 내려받는 파이프라인은 대부분 이 한 곳을 거치므로, 인수 후보 이름이 나오거나 회사가 입장을 내는 시점이 이 사안을 다시 볼 때입니다.

Hugging Face 허브의 에이전트 요청 출처 분포 도표. Claude Code가 가장 큰 비중을 차지한다

한 줄 정리

이번 주 가장 큰 것은 GPT-5.6 Sol 출력 단가가 100만 토큰 30달러에서 20달러로 내려간 일이고, 11월 21일까지의 프로모션이라 기한이 붙어 있습니다. Anthropic은 컴퓨터 사용과 Skills·Files API에서 베타 헤더를 없앴고 브라우저 전용 도구를 새로 냈습니다. DeepSeek는 텍스트와 같은 값에 이미지를 읽는 모델을 열었지만 실험 등급이고 시간대에 따라 값이 두 배 차이 납니다. 오늘 바로 쓸 수 있는 건 이 셋에 무료로 열린 Claude Academy를 더해 넷입니다. GitHub Copilot의 Slack·Teams 연동은 Copilot Business 이상이 있어야 하고, OpenAI의 훈련 중단과 Hugging Face 매각설은 각각 Astra 등급 확정과 인수 후보 공개가 다음 확인 시점입니다.