홈
AI AI
속보
심층
이벤트
Pro
더보기
자금 조달 정보
특집
온체인 생태계
용어
팟캐스트
데이터
OPRR
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
XRP
$2.25
2.07%
DOGE
$0.325
2.23%
USDC
$0.999
3.05%

구글 Gemini 3.8 TTS: 30초 샘플만으로 목소리를 복제할 수 있다

동찰 Beating AI 속보, 구글이 Gemini 3.8 Flash TTS와 Flash-Lite TTS를 발표했으며, 두 텍스트 음성 변환 모델이 Gemini API와 Google AI Studio에서 공개되었습니다. Flash는 음질, 캐릭터 연기, 장문 안정성에 중점을 두고, Lite는 높은 처리량, 낮은 지연 시간, 낮은 비용에 치중합니다.


두 모델 모두 텍스트로 새로운 음성을 설계할 수 있고, 약 30초의 참조 오디오로 본인 또는 권한을 받은 음성을 복제할 수 있습니다. 사용자는 문장별로 감정, 리듬, 억양을 제어할 수 있으며, 웃음, 한숨, 기침 등의 소리도 삽입할 수 있습니다. 2인 대화도 하나의 대본으로 바로 생성할 수 있습니다. Flash는 130개 언어를 지원하고, Lite는 101개 언어를 지원합니다.


가격도 이전 세대보다 낮아졌습니다. 2026년 12월 31일까지 Flash 오디오 출력은 백만 tokens당 9달러, Lite는 6달러입니다. 이전 세대 Gemini 3.1 Flash TTS Preview는 20달러였습니다. 2027년 1월 1일부터 두 모델의 표준 가격은 18달러와 12달러로 인상됩니다.

举报 오류 신고/제보
오류 신고/제보
제출
새 문고 추가
자신만 보기
공개
저장
문고 선택
새 문고 추가
취소
완료