
Google Gemini 现在不只是帮你写字,它开始能直接在 Google Docs 里生成和编辑图片、图表、示意图和信息图。对经常做提案、课程讲义、项目汇报的人来说,这一步很实用:同一份文档里就能把文字和视觉内容一起补齐,不必先复制到别的设计工具。
这项能力的重点不是“炫技”,而是让文档更容易读。Gemini 会把当前文档内容当作上下文来理解,所以你可以直接让它根据正文补一张说明图,或者把一段长文整理成更适合展示的信息图。不过它目前只在 Google Docs 网页版开放,而且只面向部分 Workspace、教育和 Google AI 方案,滚动推送最长可能要 15 天。
Gemini 在 Google Docs 里到底新增了什么视觉能力?
这次升级的核心,是 Gemini 可以在文档内部完成“看图、做图、改图”三件事。它不仅能根据文本生成新的视觉内容,还能修改已经放进文档里的图片,比如调整比例、改变风格,或者用同一个提示一次处理多个视觉元素。
- 根据文档内容生成图片、图表、示意图和信息图。
- 对已有视觉对象做自然语言编辑,比如改成 16:9 比例。
- 批量创建或统一多个视觉内容的风格,适合长文档和多章节材料。
这意味着 Gemini 在 Docs 里的角色更像“文档内置的视觉助手”,而不是单纯的写作补充工具。对于需要解释流程、对比方案、拆解结构的内容,它比只输出一段文字更有用。
这个功能怎么用,提示词怎么写才稳?
目前入口在 Google Docs 网页版底部工具栏或 Gemini 侧边栏。你先打开文档,再呼出 Gemini,用自然语言描述你要的视觉结果即可。系统会结合当前正文来理解上下文,所以指令写得越具体,结果通常越接近预期。
- 先确认账号所属方案是否支持这项功能。
- 在 Docs 网页版打开目标文档,找到底部 Gemini 入口或侧边栏。
- 说明用途、风格、尺寸、位置,最好把文档里的关键词写进去。
- 先看生成结果,再决定是插入、替换还是继续细改。
更好用的写法不是“帮我做一张图”,而是“根据这一段产品发布说明,生成一张适合放在首页的流程图,风格简洁,强调三个步骤”。如果你想批量处理,可以直接说“为每个章节生成风格统一的小图标或信息图”。
它适合哪些人,不适合哪些场景?
这类能力最适合写提案、培训材料、课程讲义、周报月报和产品说明的人。原因很简单:这些文档通常不只是要“写清楚”,还要“看起来更容易懂”。Gemini 能把纯文字内容快速转成视觉辅助,省掉来回切应用、手动排版的时间。
但它并不是完整的设计替代品。对品牌规范很严格、需要精细版式控制、或者要输出正式宣传物料的场景,Gemini 更适合做初稿和草图,不适合直接当最终稿。另外,文档内容会被拿来当上下文,涉及敏感信息时,先确认共享范围和权限设置会更稳。
如果你的工作重点是 AI 写作、AI 办公或多模态协作,这次更新很值得关注;如果你只是偶尔写短文档,体验增益可能没有那么明显。
我之前写过一篇关于Google Gemini的文章:《Google Gemini最新解读:Gemini app’s lates》,如果你想把这个话题继续看深一点,也可以一起对照着读。
常见问题
现在所有人都能用吗?
不能。公开信息显示,它目前只限 Google Docs 网页版,并且面向部分 Workspace、教育和 Google AI 方案,正在分批推送。
能不能把整篇文档直接变成信息图?
可以尝试。Gemini 支持基于文档内容生成信息图,但效果会受正文结构和提示词清晰度影响,最好先把重点写得更分明。
手机版能用吗?
这次更新的可用范围是网页版,移动端是否同步开放还没有看到明确说明,现阶段不要默认两端一致。
原创文章,作者:chuntian,如若转载,请注明出处:https://gemini.sflvye.net/695.html