СВЕТ НЕ СТОЈИ У МЕСТУ.RSS
BIG CHANGE.

Markdown издање

AI-translated from English; not yet reviewed by a fluent editor.

# Gemini 3.8 TTS је сада јефтинији. Цена се удвостручује 1. јануара

> Google-ови стабилни модели Gemini 3.8 TTS снижавају трошкове генерисања звука, али се цене удвостручују 1. јануара, а миграција захтева измене упутстава и обраде WAV датотека.

By BIG CHANGE Editorial

Published: 2026-09-23T18:27:39.501Z
Updated: 2026-09-23T18:27:39.501Z
Canonical: https://bigchange.ai/blog/gemini-3-8-tts-pricing-migration

![A single unbranded studio monitor sits on isolation pads on a wall-mounted shelf inside a sound-treated alcove.](https://bigchange.ai/api/media/file/gemini-tts-studio-monitor-hero-v2.png)
AI-generated conceptual illustration by BIG CHANGE.

[Google-ово представљање 23. септембра](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/) доноси два стабилна говорна модела у Gemini API и AI Studio: Flash за креативне задатке и Flash-Lite за велики обим. Приступ преко Gemini Enterprise API-ја стиже касније.

Оба коштају мање по генерисаном минуту од модела 3.1 Flash TTS Preview. Њихове стандардне цене удвостручују се 1. јануара 2027. Миграција мења и начин на који апликације шаљу упутства и чувају звук.

## Велика промена

- **Шта се променило:**  Нови ценовни нивои раздвајају текст транскрипта од упутстава за извођење и подржавају поновно коришћење гласова.
- **Зашто је важно:**  При миграцији говорног система треба узети у обзир два трошка: инжењерске измене које треба спровести сада и најављено повећање накнаде за генерисање.
- **Шта треба пратити:**  За синхронизацију, аудио-књиге и гласовне агенте упоредите разумљивост и доследност говорника на стварним продукционим сценаријима на више језика. Ти резултати ће показати да ли јефтинији генерисани минут снижава и трошак добијања употребљивог звука.

## Цена генерисања по минуту

[У Google-овој табели цена](https://ai.google.dev/gemini-api/docs/pricing?hl=en) наведено је 25 аудио-токена у секунди, односно 1.500 у минути. Обрачун је стопа излаза × 1.500 / 1.000.000; улазни текст се наплаћује додатно. Сви износи у наставку су у америчким доларима по стандардним ценама.

| Модел | Број наведених језика | Улаз / излаз на милион токена до 31. децембра 2026. | Цена излаза по минуту сада | Цена излаза по минуту од 1. јануара 2027. |
| --- | --- | --- | --- | --- |
| Gemini 3.8 Flash TTS | 130 | $0,50 / $9 | $0,0135 | $0,027 |
| Gemini 3.8 Flash-Lite TTS | 101 | $0,50 / $6 | $0,009 | $0,018 |
| Gemini 3.1 Flash TTS Preview | — | $1 / $20 | $0,03 | Промена није најављена |

За моделе 3.8, Batch и Flex коштају упола мање од Standard-а; Priority кошта 1,8 пута више од Standard-а. Google-ов [индекс модела](https://ai.google.dev/gemini-api/docs/models) препоручује замену застарелог модела 3.1 Preview једним од два нова ценовна нивоа.

## Упутства и аудио-датотеке захтевају измене

У [водичу за миграцију модела Flash](https://ai.google.dev/gemini-api/docs/models/gemini-3.8-flash-tts) пише да се текст транскрипта изговара дословно. Дуготрајна упутства и ознаке говорника уносите у тело упита `speech_metadata`; старо упутство као што је „Реци весело:“ иначе може бити изговорено наглас. Кратке звучне радње као што су `<laugh>` остају унутар текста.

У свакој размени са више говорника мора се навести говорник који одговара конфигурацији. Једнократни одговори сада садрже WAV заглавља, уместо старог подразумеваног сировог PCM формата. Уклоните код који додаје WAV заглавље или изричито затражите сирови формат.

[У документацији за Flash-Lite](https://ai.google.dev/gemini-api/docs/models/gemini-3.8-flash-lite-tts) потврђује се заједничка шема и ограничења од 8.192 улазна и 16.384 излазна токена за оба нивоа. Апликације стога могу да их упоређују преко исте интеграције.

## Репликација гласа и оцена

Google описује више од 2.000 готових гласова, осмишљавање гласа и репликацију на основу тридесетосекундног узорка гласа за који корисник има права. За репликацију је потребан снимак усмене сагласности који одговара узорку. Google наводи да генерисани аудио-снимци садрже SynthID, а да реплицирани гласови имају C2PA акредитиве.

Репликација гласа у AI Studio-у није доступна у Илиноису, Тексасу, Европском економском простору, Уједињеном Краљевству, Швајцарској и Индији.

Google пријављује резултате модела Flash од 71,4 укупно и 60,8 за моделирање акцента на тесту Hume Voice Design Benchmark. Компанија наводи да Flash и Lite заузимају прво и друго место на Hume индексу укупног квалитета.

[Artificial Analysis](https://artificialanalysis.ai/text-to-speech/models/gemini-3-8-flash-tts) је засебно навео резултат Arena Elo од 1260,15 за Flash, што је 27. место од 95 модела, на дан 23. септембра. Ово мерење бележи склоности корисника; прегледани запис не утврђује перформансе по језику ни при дугим снимцима. Овде није коришћен упоредив независан резултат за Lite.

За поређење са другом линијом говорних модела доступних преко хостованог API-ја погледајте нашу анализу [API-ја и цена Qwen Audio 3.1](https://bigchange.ai/blog/qwen-audio-3-1-models-api-pricing).

## Sources

- [Gemini 3.8 претварање текста у говор представљено је јавности](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/) — Званични обим представљања, улоге модела, број језика, говорне функције, услови сагласности, регионална доступност и резултати мерила које наводи Google. Тврдње о квалитету приписане су компанији Google.
- [Документација модела Gemini 3.8 Flash TTS](https://ai.google.dev/gemini-api/docs/models/gemini-3.8-flash-tts) — Актуелна шема захтева, ограничења улаза и излаза, обрада транскрипта, ознаке за звучне догађаје унутар текста, провера више говорника и прелазак са сировог PCM-а на подразумевани WAV излаз.
- [Документација модела Gemini 3.8 Flash-Lite TTS](https://ai.google.dev/gemini-api/docs/models/gemini-3.8-flash-lite-tts) — Актуелни опис модела за обраду великог обима, 101 наведеног језика и заједничког интерфејса за верзије 3.8.
- [Цене Gemini API-ја](https://ai.google.dev/gemini-api/docs/pricing?hl=en) — Званичне Standard, Batch, Flex и Priority цене, рок уводних цена 31. децембра, цене од 1. јануара и прерачун по стопи од 25 аудио-токена у секунди.
- [Генерисање говора](https://ai.google.dev/gemini-api/docs/speech-generation) — У актуелном водичу за говор документовани су језици верзије 3.8, обрада транскрипта и понашање при миграцији. Тренутна табела језика не утврђује број језика старијег модела Preview.
- [Gemini модели](https://ai.google.dev/gemini-api/docs/models) — У актуелном индексу модела 3.1 Flash TTS означен је као застарели модел Preview и препоручује се прелазак на Gemini 3.8 Flash TTS или Flash-Lite TTS.
- [Анализа квалитета, брзине и цене Gemini 3.8 Flash TTS-а](https://artificialanalysis.ai/text-to-speech/models/gemini-3-8-flash-tts) — Независни запис објављен на дан представљања за тачан модел Flash: Arena Elo 1260,15 и 27. место од 95 модела у време провере. Ранг може да се промени и не представља вишејезичну нити дуготрајну проверу.