Gemini 在 Google Docs 生成信息图教程:图片、图表与批量视觉编辑

演示如何在 Google Docs 中使用 Gemini 根据文档上下文生成信息图、示意图和图片,继续修改现有视觉内容、批量统一风格并排查权限与生成问题。

Google Docs 现在可以直接调用 Gemini 生成和编辑视觉内容。用户不必先去图片工具制作素材,再下载、上传和重新排版。Gemini 可以读取当前文档上下文,在正文旁生成:

  • 信息图;
  • 流程图或概念示意图;
  • 配图;
  • 多个章节对应的一组视觉内容;
  • 修改后的现有图片。

它还支持用自然语言调整比例、风格和内容。

官方更新: Generate and edit visuals with Gemini in Google Docs

快速使用步骤

  1. 在网页版 Google Docs 打开一份可编辑文档。
  2. 确认账号计划支持该功能,并启用 Workspace smart features。
  3. 从页面底部输入栏或 Gemini 侧边栏输入视觉生成要求。
  4. 说明视觉类型、要总结的范围、受众、尺寸和风格。
  5. 检查生成内容中的事实、数字、标签和文字。
  6. 用后续提示修改比例、颜色、布局或单个元素。
  7. 完成后补充替代文字,并用版本历史保存可回退状态。

这项功能从 2026 年 7 月 28 日开始渐进推出,最长可能需要 15 天才对所有符合条件的账号可见。目前只支持 Web 端。

哪些账号可以使用

Google 公布的支持范围包括:

用户类型 支持计划
Business Business Standard、Business Plus
Enterprise Enterprise Standard、Enterprise Plus
Education Education Plus
个人用户 Google AI Pro、Google AI Ultra
教育附加项 Google AI Pro for Education、Teaching and Learning

组织管理员需要启用 Gemini for Workspace in Drive。最终用户还要开启 Workspace smart features。满足计划条件但看不到入口,可能只是功能还在逐步部署。不要因为别人的账号已经出现按钮,就判断自己的配置一定有问题。

开始前先整理文档

Gemini 会参考上下文,但混乱的文档容易得到混乱的视觉结果。建议先做四项整理。

给章节使用清晰标题

使用 Docs 的标题样式,而不是只把文字加粗。例如:

  • 项目目标;
  • 当前问题;
  • 实施步骤;
  • 预算;
  • 关键风险;
  • 时间表。

结构化标题能帮助 Gemini 判断哪些内容属于同一部分。

把数字写完整

不要只写“提升很多”或“成本较低”。如果要生成图表,应提供:

  • 数字;
  • 单位;
  • 时间范围;
  • 数据来源;
  • 对比口径。

生成模型可以排版数据,但不应该被要求猜测缺失值。

标记不应进入图片的内容

文档可能包含内部备注、待确认数字和私人信息。生成前先删除、隐藏或明确排除。可以在提示中写:

只使用“公开摘要”章节,不引用“内部讨论”和“预算草稿”中的内容。

保存一个版本节点

在批量生成或编辑前,通过版本历史命名当前版本。这样可以比较生成前后布局,也能在批量修改不理想时回退。

从底部输入栏生成第一张信息图

在文档底部的 Gemini 输入栏中,不要只写“生成信息图”。一个完整提示应包含:

  1. 使用哪一部分内容;
  2. 输出什么视觉形式;
  3. 面向谁;
  4. 希望强调什么;
  5. 尺寸或比例;
  6. 文字数量限制;
  7. 风格和颜色;
  8. 不允许新增哪些事实。

例如:

1
2
3
4
5
根据本文“问题、方案和预期结果”三个章节,
在文档顶部生成一张 16:9 横向信息图。
受众是没有技术背景的项目负责人。
使用三栏结构,每栏最多三个要点,保留文中的数字和单位。
颜色使用深蓝、浅蓝和白色,不添加文档中没有的数据或案例。

生成后先检查内容,再调整美观程度。事实错误比颜色不好看更需要优先处理。

制作流程图时怎样写提示

流程图需要节点、顺序和分支。先把流程写清楚,再要求可视化。示例:

1
2
3
4
把选中的部署流程转为纵向流程图。
节点依次为:准备账号、检查权限、创建测试文档、生成视觉、人工核对、发布。
在“人工核对”后增加判断分支:通过则发布,不通过则返回修改提示。
不要增加未在列表中的工具或步骤。

如果原文存在多个并行路径,应说明哪些并行、哪些必须按顺序执行。模型不能从含糊叙述中稳定推断真实业务流程。

修改已有视觉内容

Gemini 不只生成新图,也能根据自然语言修改现有视觉内容。常见指令包括:

1
把这张图改成 16:9,保留所有文字和数字。
1
保持结构不变,把配色调整为与文档标题相同的深绿和灰色。
1
删除右下角装饰图形,放大中间的三项结论。
1
将图中的英文标签改为简体中文,产品名和 API 参数保持原文。

每次只修改一到两个主要目标,更容易判断是哪条指令造成了问题。如果一次要求换比例、改语言、重排结构、增加内容和删除元素,模型可能遗漏其中一项。

批量为多个章节添加图片

官方更新说明支持一次生成或编辑多个视觉内容。批量任务前应定义统一规则。例如:

1
2
3
4
为“准备、执行、验证、恢复”四个章节各生成一张简洁示意图。
所有图片使用相同的线条风格、蓝灰配色和 4:3 比例。
每张图只使用对应章节信息,不跨章节合并数字。
标题使用章节名,正文标签不超过五个。

批量生成后逐张检查,不要只看整体风格。常见批量错误包括:

  • 某张图用了另一章节的数据;
  • 颜色统一但图标含义不一致;
  • 同一术语在多张图里译法不同;
  • 某张图被裁切;
  • 标签字体太小;
  • 数字的小数点或百分号丢失。

如何检查生成图片中的事实

建立从内容到视觉的核对表。

数字检查

  • 与原文逐项比对;
  • 检查单位;
  • 检查百分号;
  • 检查小数位;
  • 检查时间范围;
  • 检查总和是否合理。

文字检查

  • 产品名拼写;
  • 人名和机构名;
  • 中文字符是否变形;
  • 是否存在不可读的小字;
  • 是否新增未经证实的结论。

结构检查

  • 流程方向是否正确;
  • 分支条件是否对调;
  • 图例与颜色是否一致;
  • 图片是否暗示错误因果关系;
  • 关键限制是否被省略。

生成图片不能替代原始数据和文字说明。

中文信息图常见问题

中文视觉生成可能出现:

  • 字形错误;
  • 简繁混用;
  • 技术标识符被翻译;
  • 行距过密;
  • 标点换行异常;
  • 长句塞进很小的区域。

解决方式不是不断要求“更清晰”,而是减少图中文字。先把长句改成三到六个字的标签,把解释留在正文或图注中。API 名称、文件名和命令参数应明确要求保持原样。

管理员需要检查什么

管理员应确认:

  • Gemini for Workspace in Drive 已启用;
  • 用户所在组织单元允许使用;
  • Workspace smart features 策略;
  • 计划是否包含该功能;
  • 数据区域和合规要求;
  • 外部共享策略;
  • 生成图片能否用于公开材料;
  • 员工离职后的文档访问回收。

功能默认可用不等于适合所有部门。处理合同、医疗、法律、未发布财务数据的团队,应先建立输入和审核边界。

看不到 Gemini 输入栏

按下面顺序排查:

  1. 确认使用网页版 Google Docs。
  2. 检查账号是否属于支持计划。
  3. 确认文档有编辑权限,而不是只读或评论权限。
  4. 开启 Workspace smart features。
  5. 让管理员确认 Drive 中的 Gemini 设置。
  6. 查看功能是否仍在最多 15 天的渐进部署期。
  7. 退出错误的多个 Google 账号后重新进入。

不要在个人账号和企业账号之间只看浏览器头像判断,应确认文档右上角的实际身份。

生成按钮有了但任务失败

可能原因包括:

  • 文档过长或要求范围不明确;
  • 选中内容不足;
  • 请求包含不支持的内容;
  • 网络或服务临时异常;
  • 组织策略阻止;
  • 一次要求生成太多图片;
  • 原图格式或大小不适合编辑。

先缩小到一个章节、一张图和一个明确目标。如果小任务成功,再逐步增加范围。

图片生成了但无法使用

常见表现与处理方法:

问题 处理
文字太多 减少标签,把解释移到图注
数字错误 提供明确表格,禁止新增数据
风格不一致 写明颜色、比例、线条和图标规则
比例不合适 指定 16:9、4:3 或方形
中文乱码 缩短中文标签,保留正文说明
内容被裁切 增加留白并减少边缘元素
多图术语不同 提供术语表后批量修正

不要因为图片看起来专业就跳过事实核对。

导出和发布前检查

文档导出 PDF、Word 或公开分享前,检查:

  • 图片在不同页面宽度下是否完整;
  • PDF 中字体和标签是否清楚;
  • 图注是否与图片同行;
  • 黑白打印时颜色是否仍可区分;
  • 是否需要添加来源;
  • 是否包含受版权或品牌限制的元素;
  • 是否泄露内部数据;
  • 是否提供替代文字。

对外发布时,应把生成式 AI 当作制作工具,而不是事实来源。研究、新闻、医疗和财务内容尤其需要人工审核。

无障碍处理

图片不能只靠颜色表达含义。建议:

  • 图中同时使用文字、形状或纹理;
  • 保持足够颜色对比度;
  • 避免过小字体;
  • 为图片添加替代文字;
  • 在正文保留关键数字和结论;
  • 流程图提供对应文本步骤。

屏幕阅读器不能可靠理解一张只有像素内容的信息图。可访问的正文版本仍然必要。

Docs 视觉生成功能疑问

手机端可以使用吗?

官方当前说明只支持 Web 端。移动端即使能查看文档,也不代表有相同的生成和批量编辑入口。

能自动把数据变成精确图表吗?

它可以生成视觉表达,但精确数据仍应来自可核对的表格。对正式报告,建议保留原始数据和图表制作依据。

可以一次修改多张图吗?

可以提出批量生成或编辑要求。应先定义统一规则,并逐张检查数字、标签和章节对应关系。

会读取整份文档吗?

它可以使用文档上下文。如果只想处理一部分,应选择内容并在提示中限定范围,同时移除不应参与生成的敏感信息。

让生成视觉真正可用

Gemini 在 Docs 中生成视觉内容,最适合解决“正文已经完成,但缺少清晰图示”的问题。要得到稳定结果,不要只追求一次生成漂亮图片。更可靠的流程是:

  1. 先整理文档结构和数据;
  2. 限定生成范围;
  3. 明确比例、受众和视觉规范;
  4. 逐项检查事实和文字;
  5. 用版本历史控制批量修改风险;
  6. 发布前补充无障碍说明和来源。

这样生成的图片才是文档内容的可靠表达,而不是一张无法核查的装饰图。