Google Docs 现在可以直接调用 Gemini 生成和编辑视觉内容。用户不必先去图片工具制作素材,再下载、上传和重新排版。Gemini 可以读取当前文档上下文,在正文旁生成:
- 信息图;
- 流程图或概念示意图;
- 配图;
- 多个章节对应的一组视觉内容;
- 修改后的现有图片。
它还支持用自然语言调整比例、风格和内容。
官方更新: Generate and edit visuals with Gemini in Google Docs
快速使用步骤
- 在网页版 Google Docs 打开一份可编辑文档。
- 确认账号计划支持该功能,并启用 Workspace smart features。
- 从页面底部输入栏或 Gemini 侧边栏输入视觉生成要求。
- 说明视觉类型、要总结的范围、受众、尺寸和风格。
- 检查生成内容中的事实、数字、标签和文字。
- 用后续提示修改比例、颜色、布局或单个元素。
- 完成后补充替代文字,并用版本历史保存可回退状态。
这项功能从 2026 年 7 月 28 日开始渐进推出,最长可能需要 15 天才对所有符合条件的账号可见。目前只支持 Web 端。
哪些账号可以使用
Google 公布的支持范围包括:
| 用户类型 | 支持计划 |
|---|---|
| Business | Business Standard、Business Plus |
| Enterprise | Enterprise Standard、Enterprise Plus |
| Education | Education Plus |
| 个人用户 | Google AI Pro、Google AI Ultra |
| 教育附加项 | Google AI Pro for Education、Teaching and Learning |
组织管理员需要启用 Gemini for Workspace in Drive。最终用户还要开启 Workspace smart features。满足计划条件但看不到入口,可能只是功能还在逐步部署。不要因为别人的账号已经出现按钮,就判断自己的配置一定有问题。
开始前先整理文档
Gemini 会参考上下文,但混乱的文档容易得到混乱的视觉结果。建议先做四项整理。
给章节使用清晰标题
使用 Docs 的标题样式,而不是只把文字加粗。例如:
- 项目目标;
- 当前问题;
- 实施步骤;
- 预算;
- 关键风险;
- 时间表。
结构化标题能帮助 Gemini 判断哪些内容属于同一部分。
把数字写完整
不要只写“提升很多”或“成本较低”。如果要生成图表,应提供:
- 数字;
- 单位;
- 时间范围;
- 数据来源;
- 对比口径。
生成模型可以排版数据,但不应该被要求猜测缺失值。
标记不应进入图片的内容
文档可能包含内部备注、待确认数字和私人信息。生成前先删除、隐藏或明确排除。可以在提示中写:
只使用“公开摘要”章节,不引用“内部讨论”和“预算草稿”中的内容。
保存一个版本节点
在批量生成或编辑前,通过版本历史命名当前版本。这样可以比较生成前后布局,也能在批量修改不理想时回退。
从底部输入栏生成第一张信息图
在文档底部的 Gemini 输入栏中,不要只写“生成信息图”。一个完整提示应包含:
- 使用哪一部分内容;
- 输出什么视觉形式;
- 面向谁;
- 希望强调什么;
- 尺寸或比例;
- 文字数量限制;
- 风格和颜色;
- 不允许新增哪些事实。
例如:
|
|
生成后先检查内容,再调整美观程度。事实错误比颜色不好看更需要优先处理。
制作流程图时怎样写提示
流程图需要节点、顺序和分支。先把流程写清楚,再要求可视化。示例:
|
|
如果原文存在多个并行路径,应说明哪些并行、哪些必须按顺序执行。模型不能从含糊叙述中稳定推断真实业务流程。
修改已有视觉内容
Gemini 不只生成新图,也能根据自然语言修改现有视觉内容。常见指令包括:
|
|
|
|
|
|
|
|
每次只修改一到两个主要目标,更容易判断是哪条指令造成了问题。如果一次要求换比例、改语言、重排结构、增加内容和删除元素,模型可能遗漏其中一项。
批量为多个章节添加图片
官方更新说明支持一次生成或编辑多个视觉内容。批量任务前应定义统一规则。例如:
|
|
批量生成后逐张检查,不要只看整体风格。常见批量错误包括:
- 某张图用了另一章节的数据;
- 颜色统一但图标含义不一致;
- 同一术语在多张图里译法不同;
- 某张图被裁切;
- 标签字体太小;
- 数字的小数点或百分号丢失。
如何检查生成图片中的事实
建立从内容到视觉的核对表。
数字检查
- 与原文逐项比对;
- 检查单位;
- 检查百分号;
- 检查小数位;
- 检查时间范围;
- 检查总和是否合理。
文字检查
- 产品名拼写;
- 人名和机构名;
- 中文字符是否变形;
- 是否存在不可读的小字;
- 是否新增未经证实的结论。
结构检查
- 流程方向是否正确;
- 分支条件是否对调;
- 图例与颜色是否一致;
- 图片是否暗示错误因果关系;
- 关键限制是否被省略。
生成图片不能替代原始数据和文字说明。
中文信息图常见问题
中文视觉生成可能出现:
- 字形错误;
- 简繁混用;
- 技术标识符被翻译;
- 行距过密;
- 标点换行异常;
- 长句塞进很小的区域。
解决方式不是不断要求“更清晰”,而是减少图中文字。先把长句改成三到六个字的标签,把解释留在正文或图注中。API 名称、文件名和命令参数应明确要求保持原样。
管理员需要检查什么
管理员应确认:
- Gemini for Workspace in Drive 已启用;
- 用户所在组织单元允许使用;
- Workspace smart features 策略;
- 计划是否包含该功能;
- 数据区域和合规要求;
- 外部共享策略;
- 生成图片能否用于公开材料;
- 员工离职后的文档访问回收。
功能默认可用不等于适合所有部门。处理合同、医疗、法律、未发布财务数据的团队,应先建立输入和审核边界。
看不到 Gemini 输入栏
按下面顺序排查:
- 确认使用网页版 Google Docs。
- 检查账号是否属于支持计划。
- 确认文档有编辑权限,而不是只读或评论权限。
- 开启 Workspace smart features。
- 让管理员确认 Drive 中的 Gemini 设置。
- 查看功能是否仍在最多 15 天的渐进部署期。
- 退出错误的多个 Google 账号后重新进入。
不要在个人账号和企业账号之间只看浏览器头像判断,应确认文档右上角的实际身份。
生成按钮有了但任务失败
可能原因包括:
- 文档过长或要求范围不明确;
- 选中内容不足;
- 请求包含不支持的内容;
- 网络或服务临时异常;
- 组织策略阻止;
- 一次要求生成太多图片;
- 原图格式或大小不适合编辑。
先缩小到一个章节、一张图和一个明确目标。如果小任务成功,再逐步增加范围。
图片生成了但无法使用
常见表现与处理方法:
| 问题 | 处理 |
|---|---|
| 文字太多 | 减少标签,把解释移到图注 |
| 数字错误 | 提供明确表格,禁止新增数据 |
| 风格不一致 | 写明颜色、比例、线条和图标规则 |
| 比例不合适 | 指定 16:9、4:3 或方形 |
| 中文乱码 | 缩短中文标签,保留正文说明 |
| 内容被裁切 | 增加留白并减少边缘元素 |
| 多图术语不同 | 提供术语表后批量修正 |
不要因为图片看起来专业就跳过事实核对。
导出和发布前检查
文档导出 PDF、Word 或公开分享前,检查:
- 图片在不同页面宽度下是否完整;
- PDF 中字体和标签是否清楚;
- 图注是否与图片同行;
- 黑白打印时颜色是否仍可区分;
- 是否需要添加来源;
- 是否包含受版权或品牌限制的元素;
- 是否泄露内部数据;
- 是否提供替代文字。
对外发布时,应把生成式 AI 当作制作工具,而不是事实来源。研究、新闻、医疗和财务内容尤其需要人工审核。
无障碍处理
图片不能只靠颜色表达含义。建议:
- 图中同时使用文字、形状或纹理;
- 保持足够颜色对比度;
- 避免过小字体;
- 为图片添加替代文字;
- 在正文保留关键数字和结论;
- 流程图提供对应文本步骤。
屏幕阅读器不能可靠理解一张只有像素内容的信息图。可访问的正文版本仍然必要。
Docs 视觉生成功能疑问
手机端可以使用吗?
官方当前说明只支持 Web 端。移动端即使能查看文档,也不代表有相同的生成和批量编辑入口。
能自动把数据变成精确图表吗?
它可以生成视觉表达,但精确数据仍应来自可核对的表格。对正式报告,建议保留原始数据和图表制作依据。
可以一次修改多张图吗?
可以提出批量生成或编辑要求。应先定义统一规则,并逐张检查数字、标签和章节对应关系。
会读取整份文档吗?
它可以使用文档上下文。如果只想处理一部分,应选择内容并在提示中限定范围,同时移除不应参与生成的敏感信息。
让生成视觉真正可用
Gemini 在 Docs 中生成视觉内容,最适合解决“正文已经完成,但缺少清晰图示”的问题。要得到稳定结果,不要只追求一次生成漂亮图片。更可靠的流程是:
- 先整理文档结构和数据;
- 限定生成范围;
- 明确比例、受众和视觉规范;
- 逐项检查事实和文字;
- 用版本历史控制批量修改风险;
- 发布前补充无障碍说明和来源。
这样生成的图片才是文档内容的可靠表达,而不是一张无法核查的装饰图。