Google Docs 現在可以直接呼叫 Gemini 生成和編輯視覺內容。使用者不必先去圖片工具製作素材,再下載、上傳和重新排版。Gemini 可以讀取當前文件上下文,在正文旁生成:
- 資訊圖;
- 流程圖或概念示意圖;
- 配圖;
- 多個章節對應的一組視覺內容;
- 修改後的現有圖片。
它還支援用自然語言調整比例、風格和內容。
官方更新: Generate and edit visuals with Gemini in Google Docs
快速使用步驟
- 在網頁版 Google Docs 開啟一份可編輯文件。
- 確認賬號計劃支援該功能,並啟用 Workspace smart features。
- 從頁面底部輸入欄或 Gemini 側邊欄輸入視覺生成要求。
- 說明視覺型別、要總結的範圍、受眾、尺寸和風格。
- 檢查生成內容中的事實、數字、標籤和文字。
- 用後續提示修改比例、顏色、佈局或單個元素。
- 完成後補充替代文字,並用版本歷史儲存可回退狀態。
這項功能從 2026 年 7 月 28 日開始漸進推出,最長可能需要 15 天才對所有符合條件的賬號可見。目前只支援 Web 端。
哪些賬號可以使用
Google 公佈的支援範圍包括:
| 使用者型別 | 支援計劃 |
|---|---|
| Business | Business Standard、Business Plus |
| Enterprise | Enterprise Standard、Enterprise Plus |
| Education | Education Plus |
| 個人使用者 | Google AI Pro、Google AI Ultra |
| 教育附加項 | Google AI Pro for Education、Teaching and Learning |
組織管理員需要啟用 Gemini for Workspace in Drive。終端使用者還要開啟 Workspace smart features。滿足計劃條件但看不到入口,可能只是功能還在逐步部署。不要因為別人的賬號已經出現按鈕,就判斷自己的配置一定有問題。
開始前先整理文件
Gemini 會參考上下文,但混亂的文件容易得到混亂的視覺結果。建議先做四項整理。
給章節使用清晰標題
使用 Docs 的標題樣式,而不是隻把文字加粗。例如:
- 專案目標;
- 當前問題;
- 實施步驟;
- 預算;
- 關鍵風險;
- 時間表。
結構化標題能幫助 Gemini 判斷哪些內容屬於同一部分。
把數字寫完整
不要只寫“提升很多”或“成本較低”。如果要生成圖表,應提供:
- 數字;
- 單位;
- 時間範圍;
- 資料來源;
- 對比口徑。
生成模型可以排版資料,但不應該被要求猜測缺失值。
標記不應進入圖片的內容
文件可能包含內部備註、待確認數字和私人資訊。生成前先刪除、隱藏或明確排除。可以在提示中寫:
只使用“公開摘要”章節,不引用“內部討論”和“預算草稿”中的內容。
儲存一個版本節點
在批次生成或編輯前,透過版本歷史命名當前版本。這樣可以比較生成前後佈局,也能在批次修改不理想時回退。
從底部輸入欄生成第一張資訊圖
在文件底部的 Gemini 輸入欄中,不要只寫“生成資訊圖”。一個完整提示應包含:
- 使用哪一部分內容;
- 輸出什麼視覺形式;
- 面向誰;
- 希望強調什麼;
- 尺寸或比例;
- 文字數量限制;
- 風格和顏色;
- 不允許新增哪些事實。
例如:
|
|
生成後先檢查內容,再調整美觀程度。事實錯誤比顏色不好看更需要優先處理。
製作流程圖時怎樣寫提示
流程圖需要節點、順序和分支。先把流程寫清楚,再要求視覺化。示例:
|
|
如果原文存在多個並行路徑,應說明哪些並行、哪些必須按順序執行。模型不能從含糊敘述中穩定推斷真實業務流程。
修改已有視覺內容
Gemini 不只生成新圖,也能根據自然語言修改現有視覺內容。常見指令包括:
|
|
|
|
|
|
|
|
每次只修改一到兩個主要目標,更容易判斷是哪條指令造成了問題。如果一次要求換比例、改語言、重排結構、增加內容和刪除元素,模型可能遺漏其中一項。
批次為多個章節新增圖片
官方更新說明支援一次生成或編輯多個視覺內容。批次任務前應定義統一規則。例如:
|
|
批次生成後逐張檢查,不要只看整體風格。常見批次錯誤包括:
- 某張圖用了另一章節的資料;
- 顏色統一但圖示含義不一致;
- 同一術語在多張圖裡譯法不同;
- 某張圖被裁切;
- 標籤字型太小;
- 數字的小數點或百分號丟失。
如何檢查生成圖片中的事實
建立從內容到視覺的核對表。
數字檢查
- 與原文逐項比對;
- 檢查單位;
- 檢查百分號;
- 檢查小數位;
- 檢查時間範圍;
- 檢查總和是否合理。
文字檢查
- 產品名拼寫;
- 人名和機構名;
- 中文字元是否變形;
- 是否存在不可讀的小字;
- 是否新增未經證實的結論。
結構檢查
- 流程方向是否正確;
- 分支條件是否對調;
- 圖例與顏色是否一致;
- 圖片是否暗示錯誤因果關係;
- 關鍵限制是否被省略。
生成圖片不能替代原始資料和文字說明。
中文資訊圖常見問題
中文視覺生成可能出現:
- 字形錯誤;
- 簡繁混用;
- 技術識別符號被翻譯;
- 行距過密;
- 標點換行異常;
- 長句塞進很小的區域。
解決方式不是不斷要求“更清晰”,而是減少圖中文字。先把長句改成三到六個字的標籤,把解釋留在正文或圖注中。API 名稱、檔名和命令引數應明確要求保持原樣。
管理員需要檢查什麼
管理員應確認:
- Gemini for Workspace in Drive 已啟用;
- 使用者所在組織單元允許使用;
- Workspace smart features 策略;
- 計劃是否包含該功能;
- 資料區域和合規要求;
- 外部共享策略;
- 生成圖片能否用於公開材料;
- 員工離職後的文件訪問回收。
功能預設可用不等於適合所有部門。處理合同、醫療、法律、未釋出財務資料的團隊,應先建立輸入和稽核邊界。
看不到 Gemini 輸入欄
按下面順序排查:
- 確認使用網頁版 Google Docs。
- 檢查賬號是否屬於支援計劃。
- 確認文件有編輯許可權,而不是隻讀或評論許可權。
- 開啟 Workspace smart features。
- 讓管理員確認 Drive 中的 Gemini 設定。
- 檢視功能是否仍在最多 15 天的漸進部署期。
- 退出錯誤的多個 Google 賬號後重新進入。
不要在個人賬號和企業賬號之間只看瀏覽器頭像判斷,應確認文件右上角的實際身份。
生成按鈕有了但任務失敗
可能原因包括:
- 文件過長或要求範圍不明確;
- 選中內容不足;
- 請求包含不支援的內容;
- 網路或服務臨時異常;
- 組織策略阻止;
- 一次要求生成太多圖片;
- 原圖格式或大小不適合編輯。
先縮小到一個章節、一張圖和一個明確目標。如果小任務成功,再逐步增加範圍。
圖片生成了但無法使用
常見表現與處理方法:
| 問題 | 處理 |
|---|---|
| 文字太多 | 減少標籤,把解釋移到圖注 |
| 數字錯誤 | 提供明確表格,禁止新增資料 |
| 風格不一致 | 寫明顏色、比例、線條和圖示規則 |
| 比例不合適 | 指定 16:9、4:3 或方形 |
| 中文亂碼 | 縮短中文標籤,保留正文說明 |
| 內容被裁切 | 增加留白並減少邊緣元素 |
| 多圖術語不同 | 提供術語表後批次修正 |
不要因為圖片看起來專業就跳過事實核對。
匯出和釋出前檢查
文件匯出 PDF、Word 或公開分享前,檢查:
- 圖片在不同頁面寬度下是否完整;
- PDF 中字型和標籤是否清楚;
- 圖注是否與圖片同行;
- 黑白列印時顏色是否仍可區分;
- 是否需要新增來源;
- 是否包含受版權或品牌限制的元素;
- 是否洩露內部資料;
- 是否提供替代文字。
對外發布時,應把生成式 AI 當作製作工具,而不是事實來源。研究、新聞、醫療和財務內容尤其需要人工稽核。
無障礙處理
圖片不能只靠顏色表達含義。建議:
- 圖中同時使用文字、形狀或紋理;
- 保持足夠顏色對比度;
- 避免過小字型;
- 為圖片新增替代文字;
- 在正文保留關鍵數字和結論;
- 流程圖提供對應文字步驟。
螢幕閱讀器不能可靠理解一張只有畫素內容的資訊圖。可訪問的正文版本仍然必要。
Docs 視覺生成功能疑問
手機端可以使用嗎?
官方當前說明只支援 Web 端。移動端即使能檢視文件,也不代表有相同的生成和批次編輯入口。
能自動把資料變成精確圖表嗎?
它可以生成視覺表達,但精確資料仍應來自可核對的表格。對正式報告,建議保留原始資料和圖表製作依據。
可以一次修改多張圖嗎?
可以提出批次生成或編輯要求。應先定義統一規則,並逐張檢查數字、標籤和章節對應關係。
會讀取整份文件嗎?
它可以使用文件上下文。如果只想處理一部分,應選擇內容並在提示中限定範圍,同時移除不應參與生成的敏感資訊。
讓生成視覺真正可用
Gemini 在 Docs 中生成視覺內容,最適合解決“正文已經完成,但缺少清晰圖示”的問題。要得到穩定結果,不要只追求一次生成漂亮圖片。更可靠的流程是:
- 先整理文件結構和資料;
- 限定生成範圍;
- 明確比例、受眾和視覺規範;
- 逐項檢查事實和文字;
- 用版本歷史控制批次修改風險;
- 釋出前補充無障礙說明和來源。
這樣生成的圖片才是文件內容的可靠表達,而不是一張無法核查的裝飾圖。