Google continúa ampliando las capacidades de inteligencia artificial en su ecosistema Workspace, y una de las novedades más destacadas es la incorporación de funciones de audio en Google Docs. Gracias a Gemini, ahora es posible convertir documentos en versiones narradas, una herramienta que se suma a otras mejoras recientes orientadas a facilitar la productividad y la personalización.
Lectura en voz alta con Gemini en Google Docs
La nueva función permite escuchar el contenido de los documentos directamente desde la plataforma. Los usuarios pueden elegir entre siete estilos de narración: narrador, educador, maestro, persuasor, explicador, coach y motivador. Esta variedad ofrece opciones para adaptar la experiencia según el tipo de contenido o el propósito de la lectura.
Según Google, esta herramienta puede ser útil para revisar textos, mejorar la comprensión lectora o detectar errores de redacción. Además, permite ajustar la velocidad de reproducción y seleccionar la voz que mejor se adapte a las preferencias del usuario.
Para utilizar esta función, basta con acceder al menú “Herramientas”, seleccionar “Audio” y hacer clic en “Escuchar esta pestaña”. También es posible insertar botones de audio en el documento para que otros puedan reproducir el contenido con un solo clic. Estos botones se añaden desde el menú “Insertar” y pueden personalizarse en cuanto a etiqueta, color y tamaño.
Por ahora, la función está disponible únicamente en inglés y para la versión web de escritorio de Google Docs. Está habilitada para usuarios de Google Workspace con planes Business Standard y Plus, Enterprise Standard y Plus, así como para quienes cuentan con los complementos Gemini Education, Gemini Business o suscripciones AI Pro y Ultra. Google no ha anunciado aún cuándo estará disponible en otros idiomas o versiones.
Nuevas herramientas en la opción “Insertar” de Google Docs
La sección “Insertar” ha sido ampliada con funciones que simplifican la organización de contenidos. Entre ellas se encuentra “Registro de decisiones sencillo”, que genera automáticamente una tabla con campos como tema, decisión, propietario y estado. Esta herramienta facilita el seguimiento de decisiones clave en proyectos colaborativos.
También se ha incorporado la “Tabla de seguimiento de tareas”, ideal para gestionar pendientes y verificar su estado de ejecución. En cuanto a los elementos de página, ahora se pueden añadir índice, encabezado, pie de página, marca de agua, numeración y notas al pie, lo que mejora la estructura y presentación de los documentos.
Edición de imágenes con IA en Slides y Vids
Google ha integrado funciones de edición de imágenes basadas en inteligencia artificial en Slides y Vids. Las nuevas opciones permiten eliminar el fondo de una imagen o expandirlo para modificar su proporción.
Para acceder a estas herramientas, se debe seleccionar la imagen, hacer clic en “Generar una imagen” en el panel lateral derecho y elegir “Editar”. Desde allí, se puede optar por “Expandir” para ajustar el formato o “Reemplazar el fondo”, introduciendo un prompt con las indicaciones deseadas.
Disponibilidad actual y nuevas funciones de Gemini en Google Workspace
Por el momento, la función de lectura en voz alta de documentos está disponible únicamente en inglés para usuarios de Google Workspace en Estados Unidos.
Explora Gemini Storybook: una nueva forma de dar vida a tus historias
Generación de imágenes con Gemini en Google Docs desde Android
Google ha ampliado las capacidades de su inteligencia artificial Gemini en Google Docs, permitiendo ahora la creación de imágenes directamente desde dispositivos móviles Android. Esta función, que ya estaba disponible en la versión web, se activa al seleccionar el icono de Gemini (una estrella de cuatro puntas) y describir la imagen que se desea generar. Una vez creada, puede guardarse, copiarse o insertarse en el documento.
Esta herramienta ya está habilitada en varios países y en distintos idiomas.
Consultas más precisas sobre documentos PDF en Google Drive
Google también ha mejorado las funciones de Gemini en Google Drive, incorporando una ventana de contexto de hasta un millón de tokens. Esto permite ofrecer respuestas más detalladas y precisas a las preguntas que los usuarios de Workspace formulen sobre los archivos PDF que estén visualizando. Gracias a esta mejora, es posible obtener resúmenes e información clave de manera rápida y eficiente.
