글로벌 AI 브리핑 · 공식 출처

AI 모델 소식

새 모델과 계열 확장, 가격·가용성 변화까지 발표된 순서대로 읽습니다. 쓸 수 있는 모델이 새로 생긴 발표에는 그 계열의 마크가 붙습니다.

업데이트 2026.08.01

OpenAI

MODEL ECONOMICS · 프런티어

OpenAI가 7월 30일부터 GPT-5.6 Luna 가격을 80%, Terra를 20% 내렸다. API에는 Priority Processing을 대체하는 패스트 모드가 들어가, Sol을 두 배 가격에 최대 2.5배 속도로 쓸 수 있다.

GoogleGemini Robotics ER 2

Gemini 새 모델

구글 딥마인드가 임베디드 추론 모델 Gemini Robotics ER 2를 출시했다. 로봇의 상위 두뇌 역할을 맡아 대화·상황 이해·다단계 계획을 처리하고, 실제 모터 제어는 하위 VLA 모델에 넘긴다.

GoogleGENERATIVE MUSIC

구글이 음악 생성 모델 Lyria 3.5를 Google Flow Music에 배포했다. 멜로디 구조와 가사 품질, 보컬 표현이 개선됐고 템포와 길이를 직접 조절할 수 있게 됐다.

GoogleGemini Robotics 2

Gemini 새 모델

구글 딥마인드가 Gemini Robotics 2를 공개했다. VLA와 임베디드 추론, 온디바이스 세 모델로 구성되며 휴머노이드의 발끝부터 손끝까지 전신을 제어하고 서로 다른 로봇이 협업하게 한다.

AnthropicClaude Opus 5

Claude 새 모델

앤트로픽이 Claude Opus 5를 공개했다. 백만 토큰당 입력 5달러, 출력 25달러로 Opus 4.8과 같은 가격이며 Claude Max의 새 기본 모델이자 Claude Pro에서 쓸 수 있는 가장 강한 모델이다.

GoogleGemini 3.6 Flash

Gemini 새 모델

구글이 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 세 모델을 함께 공개했다. 3.6 Flash는 100만 토큰당 입력 1.50달러·출력 7.50달러이고 Flash-Lite와 함께 오늘부터 쓸 수 있다.

GoogleGemini 3.5 Flash Cyber

Gemini 새 모델

구글이 Gemini 3.5 Flash를 보안용으로 파인튜닝한 Gemini 3.5 Flash Cyber를 공개했다. V8 엔진 테스트에서 고유 이슈 55건을 찾아 3.5 Flash를 앞섰고, 정부와 신뢰 파트너 대상 제한 파일럿으로만 제공된다.

OpenAIGPT-5.6

GPT 새 모델

OpenAI가 제한 프리뷰를 마친 GPT-5.6 제품군을 정식 출시했다. 대표 모델 Sol, 균형형 Terra, 최저가 Luna 세 등급이며 ChatGPT·Codex·API에 24시간에 걸쳐 배포된다.

OpenAIGPT-Live

GPT 새 모델

OpenAI가 차세대 음성 모델 GPT-Live를 공개하고 ChatGPT 음성 대화의 기본 모델로 적용했다. 듣기와 말하기를 동시에 처리하는 풀 듀플렉스 구조이며, 검색·추론이 필요한 작업은 백그라운드의 GPT-5.5에 위임한다.

AnthropicEXPORT CONTROLS

미국 정부가 6월 30일 수출 통제를 해제하면서 앤트로픽이 클로드 페이블 5와 미토스 5를 7월 1일부터 전 세계에 다시 배포한다. 우회 기법을 막는 분류기를 넣었고 차단된 요청은 오푸스 4.8로 넘어간다.

GoogleNano Banana 2 Lite · Gemini Omni Flash

Gemini 새 모델

구글이 이미지 모델 나노 바나나 2 라이트와 영상 모델 제미나이 옴니 플래시를 내놨다. 라이트는 1K 이미지 한 장을 4초에 만들고 장당 0.034달러, 옴니 플래시는 출력 1초당 0.10달러다.

AnthropicClaude Sonnet 5

Claude 새 모델

앤트로픽이 클로드 소네트 5를 공개했다. 추론·도구 사용·코딩을 끌어올린 에이전트형 모델로, 8월 31일까지 100만 토큰당 입력 2달러·출력 10달러의 도입 가격이 적용된다.

OpenAIGPT-5.6 Sol

GPT 새 모델

OpenAI가 GPT-5.6 계열 Sol·Terra·Luna를 제한 프리뷰로 공개했다. 신뢰할 수 있는 소수 파트너에게 API와 Codex로 먼저 제공하며, 몇 주 안에 더 넓게 공개할 계획이다.

GoogleCOMPUTER USE AGENTS

Google이 컴퓨터 사용 기능을 Gemini 3.5 Flash의 내장 도구로 넣었다. 기존에는 Gemini 2.5 기반 별도 모델로만 쓸 수 있던 기능이다.

GoogleDiffusionGemma

Gemini 새 모델

구글이 텍스트 디퓨전 방식의 오픈 웨이트 모델 DiffusionGemma를 공개했다. 토큰을 하나씩 잇는 대신 블록 단위로 병렬 생성해 자기회귀 모델보다 최대 4배 빠른 생성 속도를 낸다.

GoogleOPEN MULTIMODAL MODELS

구글이 인코더 없이 이미지와 오디오를 함께 처리하는 오픈 모델 Gemma 4 12B를 공개했다. 중간 크기 Gemma 중 처음으로 네이티브 오디오 입력을 지원하며 Apache 2.0 라이선스로 배포된다.

PALDYN / AI LAB

AI를 이해하고 배우는 데 필요한 개념, 수학, 논문과 실험을 연결해 기록합니다.

OfficialTech Blog© 2026 PALDYN