IA en el espacio de trabajo
Google Docs elimina la pantalla dividida: Gemini dibuja diagramas a partir de tu texto
Google Docs ahora te permite generar y editar imágenes, infografías y diagramas directamente usando Gemini en la barra lateral o la barra inferior, aprovechando el contexto del documento para mayor relevancia. El despliegue comenzó el 28 de julio de 2026 para los niveles de pago de Workspace.
Emmanuel Fabrice Omgbwa Yasse Asistido por IA
2026-07-29 · 3 min de lectura

Probablemente has elaborado un informe dividiendo tu pantalla entre un documento y una herramienta de imágenes separada, esperando que el arte coincida con el texto. Ese flujo de trabajo ahora es opcional. Google está lanzando la capacidad de generar y editar visuales directamente dentro de Google Docs usando Gemini, anunció la compañía el 28 de julio.
La función va más allá de la simple generación de imágenes. Gemini lee el documento en el que estás trabajando y puede producir diagramas, infografías o ilustraciones que coincidan con el contenido. Puedes pedirle que Añada un diagrama que proporcione una visión general de la propuesta en la parte superior de mi documento y obtener algo que realmente encaje. También puedes refinar visuales existentes con comandos en lenguaje natural como Cambia la relación de aspecto a 16:9 o Haz que el estilo sea más estético.
Puedes crear o editar múltiples visuales a la vez, diciéndole a Gemini que añada infografías en cada sección clave o que actualice el estilo de varios gráficos juntos. La capacidad es accesible desde la barra inferior o el panel lateral de Gemini en Docs basado en web por ahora.
Google está poniendo la función disponible gradualmente durante un máximo de 15 días a partir del 28 de julio. Requiere que Gemini for Workspace esté habilitado. Del lado del administrador, la función está activada por defecto si Gemini in Drive está activo. Los usuarios finales necesitan tener activadas las funciones inteligentes de Workspace.
La disponibilidad es por niveles. Los suscriptores de Business Standard y Plus, Enterprise Standard y Plus, Education Plus, y los consumidores de Google AI Pro y Ultra obtienen acceso. Los complementos educativos que incluyen Google AI Pro for Education también califican.
Esta adición continúa un impulso que Google ha estado haciendo en su suite de productividad. A principios de este año, la compañía añadió capacidades de Gemini a Gmail, Calendar, Chat y Sheets. Más recientemente, lanzó Vids, una herramienta que usa Gemini Omni para generar videos a partir de texto y permite insertar un avatar personal, convirtiendo efectivamente una selfie en un estudio de producción. Cada clip obtiene una marca de agua SynthID invisible. Esa misma lógica de marca de agua podría aplicarse a las imágenes generadas en Docs, aunque Google no lo confirmó. Estos movimientos reflejan una tendencia en la que las herramientas de IA incorporan capacidades generativas directamente en la interfaz, similar a cómo ElevenLabs convirtió la producción de video en una conversación. Microsoft también ha estado integrando IA en su suite de productividad, con su modelo interno MAI que iguala a GPT-5.6 en Excel a un costo menor.
Google también está profundizando la capa de modelo subyacente. Los lanzamientos recientes incluyen Gemini 3.5 Flash Cyber, una variante restringida a defensores gubernamentales, y Gemini 3.6 Flash que apareció en la aplicación Gemini. La compañía ha dicho que inició su ejecución de preentrenamiento más ambiciosa para Gemini 4. Este impulso hacia variantes especializadas se alinea con un cambio más amplio: la orquestación y la especialización ahora importan tanto como el tamaño bruto del modelo. Mientras tanto, los modelos MAI de Microsoft están reduciendo los costos de producción en un 89%, mostrando la presión competitiva sobre los proveedores para reducir los gastos de inferencia. La generación de imágenes en Docs se basa en Gemini, pero no se reveló la versión específica del modelo que lo impulsa.
Esto cambia el flujo de trabajo. Durante años, la creación de documentos significaba ensamblar texto y visuales a partir de herramientas separadas. Ahora la IA que escribe el texto también puede generar los gráficos. La conciencia del contexto mantiene la relevancia de la salida. La edición en lenguaje natural elimina la necesidad de habilidades de diseño para pulir un gráfico. Un pequeño cambio en el papel; uno grande en la práctica.
Lo esencial de la tecnología en 3 minutos cada mañana
Un correo, cada día laborable, con lo que realmente importa en IA y tecnología.