AI-translated from English; not yet reviewed by a fluent editor.
# Google ofrece Live Avatar con Gemini 3.8 Live a las empresas
> Gemini 3.8 Live de Google ahora ofrece un avatar de vídeo parlante a través de su API empresarial. Los avatares predeterminados ya están disponibles de forma general; el acceso a imágenes personalizadas sigue restringido.
By BIG CHANGE Editorial
Published: 2026-09-25T05:04:12.524Z
Updated: 2026-09-25T05:04:12.524Z
Canonical: https://bigchange.ai/blog/gemini-3-8-live-avatar-enterprise-availability

AI-generated conceptual illustration by BIG CHANGE.
El 24 de septiembre, Google puso Live Avatar a disposición general junto con Gemini 3.8 Live. La función añade un rostro animado que habla al modelo de voz en tiempo real de la empresa, que también puede recibir imágenes de una cámara o de la pantalla y llamar a herramientas externas durante una conversación. Para los desarrolladores de agentes de atención al cliente, el cambio práctico es contar con salida de vídeo integrada y una vía de acceso documentada mediante API. El anuncio no demuestra que un avatar mejore los resultados del servicio ni que funcione de forma fiable en todos los contextos.
## El gran cambio
- **Qué ha cambiado:** La [guía para desarrolladores](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/guides/gemini-3-8-live) añade vídeo sincronizado del avatar a la salida de voz que ya ofrecía el modelo Live anterior. Ahora, los desarrolladores pueden obtener un rostro parlante y voz mediante una sola API de transmisión en tiempo real.
- **Por qué importa:** Los equipos que crean agentes de atención al cliente pueden añadir esa presencia visual sin desarrollar por separado un sistema para generar avatares. Sus aplicaciones aún deben ejecutar las llamadas a herramientas y gestionar los fallos; la animación no demuestra que una transacción se haya completado.
- **Qué conviene observar:** La decisión inmediata de diseño es elegir entre un avatar predeterminado y una imagen personalizada. La documentación de Google sobre [configuración](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/live-api/configure-live-avatars) limita los avatares personalizados a determinados clientes y exige derechos y consentimiento para usar muestras de rostros o voces. Por tanto, adoptar una imagen de marca requiere una decisión aparte sobre el acceso y el consentimiento.
## El avatar ya está disponible; crear una imagen personalizada requiere autorización aparte
En su [anuncio de lanzamiento](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-with-live-avatar/), Google muestra avatares que responden a audio e imágenes en directo, cambian de idioma y continúan una conversación para registrarse en un hotel mientras se ejecuta una llamada a una herramienta. Son demostraciones de la empresa. Ilustran la interacción prevista, pero no aportan tasas de error medidas, resultados de accesibilidad ni pruebas de una mejor atención al cliente.
El [anuncio de Google Cloud](https://cloud.google.com/blog/products/ai-machine-learning/gemini-3-8-live-with-live-avatar-is-now-generally-available) indica que la función está disponible de forma general en Gemini Enterprise y mediante la API, con puntos de acceso en Estados Unidos y la Unión Europea. Los desarrolladores pueden elegir entre avatares predeterminados. La creación de un avatar a partir de la imagen de referencia de una persona sigue limitada a determinados clientes empresariales, que deben solicitar acceso a través de Google Cloud. La [guía de configuración](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/live-api/configure-live-avatars) indica que los clientes son responsables de obtener los derechos y consentimientos necesarios para procesar muestras de rostro o voz.
La página del modelo enumera `gemini-3.8-live` y disponibilidad en las multirregiones de `us` y `eu` y en `us-central1`. También enumera el pago por uso estándar y el rendimiento aprovisionado como opciones de consumo admitidas. Antes de dar por hecho que la disponibilidad general implica acceso universal, los equipos deben comprobar el punto de acceso y las condiciones comerciales aplicables a su propia implementación.
## La conversación sigue dependiendo de la aplicación
Google describe Gemini 3.8 Live como un sistema de voz a voz que puede recibir imágenes en directo de una cámara o compartir la pantalla y devolver voz y vídeo. La [guía para desarrolladores](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/guides/gemini-3-8-live) distingue entre llamadas que se ejecutan mientras el agente sigue hablando y llamadas bloqueantes que esperan una respuesta. La aplicación aún debe conectar y autorizar sus propias herramientas, gestionar los resultados y decidir qué acciones puede realizar el agente. Que el rostro permanezca en pantalla mientras se consulta información no demuestra que la consulta haya tenido éxito.
La guía indica que las respuestas de las herramientas deben comunicar un estado y señalar si conviene reintentar; deben corresponder al ID de la llamada original, y los desarrolladores deben limitar las llamadas repetidas. Estos requisitos influyen, por ejemplo, en cómo responde un agente cuando una consulta de cuenta no devuelve resultados o se interrumpe. Google también afirma que Gemini 3.8 Live puede cambiar entre 97 idiomas. En este análisis no se ha medido de forma independiente la afirmación del anuncio de que los movimientos de los labios se mantienen sincronizados en todos ellos.
Google afirma que el audio y el vídeo generados llevan marcas de agua SynthID y restringe la creación de imágenes personalizadas. Son salvaguardas declaradas, no pruebas de que todos los espectadores reconocerán que el avatar es sintético ni de que se evitará el uso indebido. Para evaluar una implementación habría que comprobar el consentimiento, la divulgación, el tratamiento de los datos de voz y de cámara en directo, los fallos de las llamadas a herramientas, el comportamiento ante interrupciones y el rendimiento observado con sus usuarios reales. El material de lanzamiento y la documentación publicados no ofrecen esos resultados.
## Fuentes y lecturas adicionales
- [El anuncio de Live Avatar de Google](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-with-live-avatar/) (24 de septiembre de 2026) describe y muestra las interacciones previstas por la empresa, sus afirmaciones sobre los avatares multilingües y SynthID. Las demostraciones no son pruebas independientes de rendimiento.
- [Publicación de Google Cloud sobre la disponibilidad general](https://cloud.google.com/blog/products/ai-machine-learning/gemini-3-8-live-with-live-avatar-is-now-generally-available) (24 de septiembre de 2026) especifica la disponibilidad empresarial, los puntos de acceso de Estados Unidos y la Unión Europea, los avatares predeterminados y personalizados sujetos a autorización, y ejemplos de aplicaciones. Los comentarios de clientes son testimonios promocionales, no mediciones de resultados utilizadas en este artículo.
- [Guía para desarrolladores de Gemini 3.8 Live](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/guides/gemini-3-8-live) (actualizada el 24 de septiembre de 2026) documenta la comparación entre modelos, el formato de transmisión y el comportamiento de las llamadas a herramientas. Describe el funcionamiento de la API, no el rendimiento medido en una implementación concreta.
- [Página del modelo Gemini 3.8 Live](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/gemini/3-8-live) (actualizada el 24 de septiembre de 2026) enumera el ID del modelo, la fecha de disponibilidad general, las regiones y las opciones de consumo. Conviene volver a comprobar la disponibilidad para cada proyecto y punto de acceso.
- [Configurar avatares en directo](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/live-api/configure-live-avatars) (consultada el 25 de septiembre de 2026) explica la configuración de la API para avatares predeterminados y los requisitos de acceso y consentimiento para imágenes personalizadas.
## Sources
- [Presentamos Gemini 3.8 Live con Live Avatar](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-with-live-avatar/) — La publicación de lanzamiento de Google describe y muestra la interacción prevista, las afirmaciones sobre avatares multilingües y SynthID. Las demostraciones de la empresa no son pruebas independientes de rendimiento ni de resultados para clientes.
- [Potencia tus agentes: Live Avatar con Gemini 3.8 Live ya está disponible de forma general](https://cloud.google.com/blog/products/ai-machine-learning/gemini-3-8-live-with-live-avatar-is-now-generally-available) — Google Cloud especifica la disponibilidad empresarial y mediante API, los puntos de acceso de Estados Unidos y la Unión Europea, los avatares predeterminados y personalizados sujetos a autorización, y ejemplos de aplicaciones. Los comentarios de clientes son testimonios promocionales, no mediciones de resultados utilizadas en este artículo.
- [Guía para desarrolladores de Gemini 3.8 Live](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/guides/gemini-3-8-live) — La comparación de modelos de Google, los formatos de transmisión, el comportamiento de las llamadas a herramientas y los requisitos de integración. Documenta el comportamiento previsto de la API, no el rendimiento en una implementación concreta.
- [Página del modelo Gemini 3.8 Live](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/gemini/3-8-live) — Enumera el ID del modelo, la fecha de disponibilidad general, las regiones y las opciones de consumo. La autorización para cada proyecto y la disponibilidad de la implementación deben comprobarse por separado.
- [Configurar avatares en directo](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/live-api/configure-live-avatars) — Configuración de la API para avatares predeterminados, así como acceso restringido, consentimiento y requisitos de imagen para las imágenes personalizadas. La guía documenta la configuración, no los resultados observados.
El boletín de BIG CHANGE
La visión global, a tu ritmo.
Historias recientes sobre IA y robótica, cambios que vale la pena observar e ideas prácticas para usar. Elige un informe diario, un resumen semanal o una perspectiva mensual.
Next scheduled send (UTC): . Your first edition arrives at the next scheduled send after you confirm.
Tu privacidad, tu elección.
El almacenamiento necesario ayuda a proteger el sitio y a recordar tus preferencias. Google Analytics opcional permanece desactivado hasta que lo autorices. Puedes leer todas las historias usando solo el almacenamiento necesario. Detalles de privacidad