어제(9월 24일) 구글이 Gemini 3.8 Live에 Live Avatar를 붙였습니다. 말하면서 화면에도 사람이 나오는 식입니다. 하루 전(9월 23일)에는 같은 오디오 계열로 텍스트를 목소리로 바꾸는 Flash TTS도 풀렸고 Cursor는 배포를 지켜보는 Rollouts와 PR 보안 봇을 Teams·Enterprise에 열었습니다. 새 모델 이름 나열보다, 이미 쓰는 대화·음성·배포 화면이 바뀐 쪽에 가깝습니다.

오늘 하나만 본다면 — Gemini Live Avatar, 말로 하면서 얼굴도 나옴

구글 블로그(9월 24일)를 보면 됩니다. 지난주 나온 Gemini 3.8 Live에 낮은 지연의 스트리밍 영상을 붙인 기능이 Live Avatar입니다. 듣고 보고 말하되 입 모양·표정·말 주고받기가 같이 움직인다고 적혀 있습니다.

기업용 Gemini Enterprise에서 오늘부터 쓸 수 있습니다. 손님 체크인처럼 도구를 뒤에서 돌리면서도 대화는 끊지 않는 장면을 데모로 보여 줍니다. 입술·표정은 97개 언어에 맞춰 바뀌고 중간에도 언어를 바꿔도 영상 품질이 크게 깨지지 않는다고 합니다. 미리 만든 아바타 말고 참고 사진으로 브랜드에 맞는 아바타를 만들 수도 있는데 이 커스텀은 지금 기업 허용 목록(allowlist)에서만 됩니다. 나온 오디오·영상에는 SynthID 워터마크가 들어갑니다.

일반 Gemini 앱 무료 사용자에게 바로 열린 기능은 아닙니다. 기업 쪽 에이전트·고객 응대를 다루는 분이면 API 문서부터 보면 됩니다.

써볼 만한 도구 — Gemini 3.8 Flash TTS, AI Studio에서 목소리 설계

9월 23일 구글이 Gemini 3.8 Flash TTS와 Flash-Lite TTS를 공개했습니다. 예전처럼 고정 목소리 목록만 고르는 수준이 아니라, 문장으로 “이런 캐릭터·억양”을 말해 새 목소리를 만들고 줄마다 연기·템포·방언을 지시할 수 있습니다. Flash는 창작·캐릭터 쪽에, Flash-Lite는 대량·비용 쪽에 맞춰 두었습니다.

쓰는 곳은 나뉩니다. Flash TTS는 Gemini API·Google AI Studio·Gemini Notebook에, Flash-Lite TTS는 API·AI Studio·Google Vids에 오늘부터 풀린다고 합니다. 기업 API는 Gemini Enterprise에 “곧”입니다. AI Studio는 목소리 디자인 워크스페이스처럼 생겼고 새 목소리를 만든 뒤 두 화자 대본 편집기로 넘길 수 있습니다. 제작 준비된 목소리만 2,000개 넘게 있고 30초 샘플로 복제(동의 녹음·SynthID·C2PA)도 됩니다. 다만 AI Studio 음성 복제는 일리노이·텍사스·EEA·영국·스위스·인도에서는 안 됩니다.

가격은 공식 pricing 기준입니다. 표준 유료에서 프로모션이 2026년 12월 31일까지입니다. Flash TTS는 텍스트 입력 100만 토큰당 $0.50, 오디오 출력 100만 토큰당 $9.00입니다. Flash-Lite TTS는 텍스트 입력은 같고 오디오 출력은 $6.00입니다. 2027년 1월 1일부터는 각각 텍스트 $1.00, 오디오 $18.00 / $12.00으로 올라갑니다. 오디오 토큰은 초당 25개로 환산합니다. AI Studio에서 먼저 들어 보고 API 모델 ID는 gemini-3.8-flash-tts / gemini-3.8-flash-lite-tts입니다.

챗GPT 쪽도 Help Center가 정리해 두었습니다. Live 음성 대화에서 계정에 연결된 플러그인·앱을 말할 수 있게 됐고 웹·모바일 Work에서도 Live로 문서·발표·스프레드시트·브라우저 작업을 시킬 수 있습니다. Voice와 Work 권한이 둘 다 있어야 합니다. 승인 필요한 동작은 화면에서만 확인하고 말로 승인하진 않습니다. Live는 영상·화면 공유가 없고 그게 필요하면 Advanced를 씁니다.

개발자라면 — Cursor Rollouts·Security Review, Teams·Enterprise

Cursor changelog(9월 23일)에 Rollouts와 Security Review 두 봇이 올라왔습니다. Teams와 Enterprise에서 자동화(Automations) 탭으로 켭니다.

Rollouts는 PR마다 모니터를 붙이고 배포가 나가면 환경별로 “검증된 정상 / 회귀 탐지 / 판단 불가”를 남깁니다. PR이 열리면 diff를 읽고 모니터링 플랜을 댓글로 달고 플랜은 PR에서 고칠 수 있습니다. 회귀가 보이면 작성자에게 알리고 설정에 따라 revert PR을 열거나 클라우드 Agent에 넘길 수 있습니다. 지금 Rollouts 자체가 병합·롤백을 직접 하지는 않습니다. Origin 또는 GitHub, CD, Datadog 같은 텔레메트리와 연결합니다. 출시 후 10일 동안 Teams는 약 50건, Enterprise는 약 500건 분량의 Rollouts 사용 크레딧이 포함됩니다.

Security Review는 초안이 아닌 PR을 코드베이스 맥락에서 읽고 악용 가능한 버그를 한 줄 리뷰로 남깁니다. 스타일·품질은 기존 Bugbot이 맡습니다. SQL·명령·템플릿 인젝션, 인증·인가 우회, 소스에 올라간 시크릿, SSRF·검증 없는 리다이렉트, 위험한 역직렬화, 취약 의존성 변경을 봅니다. 심각도·공격 경로·수정 제안이 붙고 사유를 남기고 해제하면 같은 PR에서 같은 항목을 다시 안 올립니다. 팀 규칙도 걸 수 있습니다. 예를 들어 외부 호출은 이 클라이언트만 쓰게 하거나, 요청 핸들러에서 특정 테이블 조회를 막는 식입니다.

출처

- Introducing Gemini 3.8 Live with Live Avatar — https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-with-live-avatar/

- Gemini 3.8 text-to-speech says hello — https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/

- Gemini API pricing — https://ai.google.dev/gemini-api/docs/pricing

- Rollouts and Security Review — https://cursor.com/changelog/rollouts-and-security-reviewer

- ChatGPT Voice — https://help.openai.com/en/articles/20001274/

오늘 한 줄 — 기업이면 Live Avatar·API 문서를, 목소리 작업이면 AI Studio Flash TTS를, Cursor Teams면 Automations에서 Rollouts·Security Review를 한 번 켜 보면 됩니다.