工作空间中的AI
Google Docs 终结分屏:Gemini 从你的文本绘制图表
Google Docs 现在允许你直接在侧边栏或底部栏中使用 Gemini 生成和编辑图像、信息图和图表,利用文档上下文确保相关性。该功能于 2026 年 7 月 28 日开始向付费 Workspace 层级推出。

你可能曾经通过将屏幕分成文档和单独的图像工具来构建报告,希望图像与文本匹配。现在这一工作流程已不再是必需。谷歌于7月28日宣布,正在推出使用 Gemini 直接在 Google Docs 内生成和编辑视觉元素的功能。
该功能远不止简单的图像生成。Gemini 会读取你正在处理的文档,并生成与内容匹配的图表、信息图或插图。你可以要求它在文档顶部添加一个提供提案概览的图表,并得到确实合适的内容。你还可以使用自然语言命令来优化现有视觉元素,例如将宽高比改为16:9或使风格更美观。
你可以一次性创建或编辑多个视觉元素,告诉 Gemini 在每个关键部分添加信息图,或同时更新多个图形的样式。目前,该功能仅可通过网络版 Docs 的底部栏或 Gemini 侧面板访问。
谷歌将从7月28日开始,在最多15天内逐步推出该功能。它需要启用 Gemini for Workspace。在管理端,如果 Gemini in Drive 处于活动状态,该功能默认开启。最终用户需要开启 Workspace 智能功能。
可用性是分层的。Business Standard 和 Plus、Enterprise Standard 和 Plus、Education Plus 以及消费者版 Google AI Pro 和 Ultra 订阅者均可使用。包括 Google AI Pro for Education 在内的教育附加组件也有资格使用。
这一新增功能延续了谷歌在其生产力套件中持续推动的举措。今年早些时候,该公司将 Gemini 功能添加到了 Gmail、Calendar、Chat 和 Sheets 中。最近,它推出了 Vids,这是一个使用 Gemini Omni 从文本生成视频的工具,并允许你插入个人头像,实际上将自拍变成了一个制作工作室。每个片段都有一个不可见的 SynthID 水印。同样的水印逻辑可能适用于 Docs 生成的图像,尽管谷歌没有确认这一点。这些举措呼应了一个趋势:AI 工具将生成能力直接嵌入界面,类似于ElevenLabs 将视频制作变成了一次聊天对话。微软也一直在将 AI 集成到其生产力套件中,其内部MAI 模型以较低成本在 Excel 中匹配 GPT-5.6。
谷歌也在深化底层模型层。最近的发布包括 Gemini 3.5 Flash Cyber(一个仅限于政府防御者的变体)以及出现在 Gemini 应用中的 Gemini 3.6 Flash。该公司表示,它已开始了 Gemini 4 最雄心勃勃的预训练运行。这种向专业化变体的推动与更广泛的转变一致:编排和专业化现在与原始模型大小同等重要。与此同时,微软的 MAI 模型正在将生产成本降低 89%,这表明提供商面临降低推理费用的竞争压力。Docs 图像生成依赖于 Gemini,但驱动它的具体模型版本并未披露。
这改变了工作流程。多年来,文档创建意味着从不同的工具中组合文本和视觉元素。现在,撰写文本的 AI 也可以生成图形。上下文感知使输出保持相关性。自然语言编辑消除了设计技能来润色图表的需要。纸上一个小改变;实践中一个大改变。
每天早晨用 3 分钟掌握科技要闻
每个工作日一封邮件,只讲真正重要的 AI 与科技动态。