Devlery - AI 개발자를 위한 AI 뉴스 큐레이션
Devlery blog
AI 개발자를 위한 최신 AI 뉴스 큐레이션.
NVIDIA 320억 로보택시 모델, 폐쇄 루프 학습까지 공개
NVIDIA Alpamayo 2 Super는 32B VLA, AlpaGym, OmniDreams, agent skills를 묶어 L4 로보택시 개발 파이프라인을 엽니다.
QVAC 0.12.0 공개, TurboQuant로 줄이는 로컬 KV 캐시
Tether가 QVAC SDK 0.12.0과 TurboQuant 구현을 발표했습니다. KV 캐시 압축, 코드 흔적, vLLM 반론까지 개발자 관점에서 봅니다.
Copilot 코드 리뷰 과금 시작, 비공개 PR의 Actions 분 차감
GitHub Copilot code review가 6월 1일부터 AI Credits와 Actions minutes를 함께 소비합니다. 비공개 PR 자동 리뷰 예산을 점검할 때입니다.
AgentCore A/B 테스트 공개, 프롬프트 수정도 배포 실험으로
AWS AgentCore Optimization preview는 trace 기반 추천, batch eval, A/B test로 에이전트 품질 개선 루프를 제품화합니다.
DGX Station for Windows 공개, 1조 모델이 책상 위로
NVIDIA가 GB300 기반 DGX Station for Windows를 공개했습니다. 784GB 메모리와 dual boot로 기업 책상 위 AI 에이전트 장비를 겨냥합니다.
Copilot ISO 42001 확대, Studio 에이전트까지 감사
Microsoft가 Copilot ISO 42001 범위를 Copilot Studio, GitHub Copilot, Dragon Copilot, Copilot Health로 넓혔습니다.
Nova Act 100단계 제한, 브라우저 에이전트의 AWS 책임선
AWS Nova Act Service Card가 브라우저 에이전트의 100단계, 30분 세션, prompt injection 책임 경계를 문서화했습니다.
QVAC AI SDK Provider 공개, 로컬 모델을 AI SDK로 호출
Tether QVAC이 Vercel AI SDK provider를 공개했습니다. 로컬 OpenAI 호환 서버와 코딩 에이전트 연결 방식, 한계를 짚습니다.
Salt Code 40개 정책 공개, MCP로 코딩 어시스턴트를 통제
Salt Code는 MCP로 AI 코딩 어시스턴트에 보안 정책을 연결하고, 4개 팩과 40개 이상 정책을 생성 단계에 적용합니다.
Command A+ 공개, 2개 H100으로 돌리는 오픈웨이트 MoE
Cohere Command A+는 Apache 2.0, 218B MoE, 25B active, 128K context, 2개 H100 배포를 앞세운 기업용 오픈웨이트 모델입니다.
SageMaker OpenAI API 지원, AWS 모델 배포의 새 선택지
AWS SageMaker가 /openai/v1 endpoint를 지원합니다. OpenAI SDK, LangChain, Strands agent를 AWS hosted model로 옮기는 비용이 낮아졌습니다.
MiniMax M3 공개, 1M 컨텍스트 오픈웨이트 코딩 모델
MiniMax M3는 1M 컨텍스트, 멀티모달, 코딩 에이전트 벤치마크를 묶었지만 weights와 리포트는 아직 검증 대상입니다.