Google Docsは、Gemini を直接呼び出してビジュアル コンテンツを生成および編集できるようになりました。ユーザーは、画像ツールに移動して素材を作成し、それをダウンロード、アップロード、並べ替える必要がありません。 Gemini は現在のドキュメントのコンテキストを読み取り、テキストの横に次の内容を生成できます。
- インフォグラフィック。
- フローチャートまたは概念図。
- 写真付き。
- 複数の章に対応する一連のビジュアル コンテンツ。
- 既存の画像を修正しました。
自然言語を使用したスケール、スタイル、コンテンツの調整もサポートしています。
公式アップデート: Google Docsで Gemini を使用してビジュアルを生成および編集
使用するための簡単な手順
- ウェブ上の Google Docsで編集可能なドキュメントを開きます。
- アカウント プランがこの機能をサポートしていることを確認し、Workspace スマート機能を有効にします。
- ページ下部の入力フィールドまたは Gemini サイドバーからビジュアル ビルド要件を入力します。
- ビジュアルの種類、要約する範囲、対象者、サイズ、スタイルを説明します。
- 生成されたコンテンツの事実、図、ラベル、テキストを確認します。
- 後続のプロンプトを使用して、スケール、色、レイアウト、または個々の要素を変更します。
- 完了後、代替テキストを追加し、バージョン履歴を使用して元に戻せる状態を保存します。
この機能は、2026 年 7 月 28 日から段階的に展開され、対象となるすべてのアカウントに表示されるまでに最大 15 日かかる場合があります。現在は Web 側のみをサポートしています。
使用できるアカウント
Google が発表したサポート内容は次のとおりです。
| ユーザータイプ | サポートプラン |
|---|---|
| ビジネス | Business Standard、Business Plus |
| エンタープライズ | Enterprise Standard、Enterprise Plus |
| 教育 | Education Plus |
| 個人ユーザー | Google AI Pro、Google AI Ultra |
| 教育用アドオン | Google AI Pro for Education、Teaching and Learning |
組織管理者は、Gemini for Workspace in Drive を有効にする必要があります。エンド ユーザーも Workspace スマート機能を有効にする必要があります。プログラムの条件は満たしているが入り口が見えない場合は、まだ機能が段階的に展開されている途中である可能性があります。他の人のアカウントにボタンが表示されたからといって、自分の設定に何か問題があるに違いないと判断しないでください。
始める前に書類を整理する
Gemini はコンテキストを参照しますが、乱雑なドキュメントは簡単に乱雑な視覚的結果につながる可能性があります。最初に 4 つのことを行うことをお勧めします。
章には明確なタイトルを使用する
テキストを太字にするだけではなく、ドキュメントの見出しスタイルを使用します。たとえば:
- プロジェクトの目標。
- 現在の問題。
- 実装手順。
- 予算。
- 主要なリスク。
- 時刻表。
構造化された見出しは、Gemini がどのコンテンツが同じセクションに属するかを判断するのに役立ちます。
数字を完全に書きましょう
「大幅に改善されました」または「コストが削減されました」とだけ書かないでください。グラフを生成したい場合は、以下を指定する必要があります。
- 数字。
- 単位。
- 時間範囲。
- データソース。
- 口径を比較してください。
生成モデルはデータをフォーマットできますが、欠損値を推測する必要はありません。
画像に含めるべきではないコンテンツにマークを付けます
文書には、内部メモ、確認すべき番号、個人情報が含まれる場合があります。生成する前に削除、非表示、または明示的に除外します。プロンプトに次のように書き込むことができます。
「公開概要」セクションのみを使用し、「内部議論」や「予算案」の内容を引用しないでください。
バージョンノードを保存する
バッチビルドまたは編集の前に、バージョン履歴に基づいて現在のバージョンに名前を付けます。このようにして、生成前と生成後のレイアウトを比較でき、バッチ変更が理想的でない場合はロールバックすることもできます。
下部の入力フィールドから最初のインフォグラフィックを生成します
ドキュメントの下部にある Gemini 入力フィールドに、「インフォグラフィックを生成」とだけ書かないでください。完全なプロンプトには次のものが含まれている必要があります。
- コンテンツのどの部分を使用するか。
- どのような視覚的な形式で出力されるか。
- 誰に。
- 何を強調したいのか;
- サイズまたは比率。
- テキストの数量制限。
- スタイルと色。
- 追加が許可されていない事実はどれですか。
たとえば:
|
|
生成後は内容を確認してから見た目を調整します。事実上の誤りは、醜い色よりも優先されます。
フローチャート作成時のプロンプトの書き方
フローチャートにはノード、シーケンス、分岐が必要です。まずはプロセスを明確に書き、それから可視化を求めます。例:
|
|
元のテキストに複数の並列パスがある場合は、どれが並列で、どれが順番に実行される必要があるかを明記する必要があります。モデルは、曖昧な物語から実際のビジネス プロセスを確実に推測することはできません。
既存のビジュアルコンテンツを変更する
Gemini は新しい画像を生成するだけでなく、自然言語に基づいて既存のビジュアル コンテンツを変更することもできます。一般的な指示には次のようなものがあります。
|
|
|
|
|
|
|
|
一度に 1 つまたは 2 つの主要なターゲットのみを変更することで、どの命令が問題の原因となっているかを簡単に特定できます。縮尺の変更、言語の変更、構造の再配置、コンテンツの追加、要素の削除を一度に要求された場合、モデルはそれらのうちの 1 つを欠落する可能性があります。
複数の章に画像を一括で追加する
公式アップデートノートでは、複数のビジュアルコンテンツを一度に生成または編集することがサポートされています。統一ルールはバッチタスクの前に定義する必要があります。たとえば:
|
|
バッチ生成後、各画像を 1 つずつ確認します。全体的なスタイルだけを見ないでください。一般的なバッチ エラーには次のようなものがあります。
- ある図は別の章のデータを使用しています。
- 色は統一されていますが、アイコンの意味は一貫していません。
- 同じ用語が複数の図で異なって翻訳されています。
- ある写真がトリミングされています。
- ラベルのフォントが小さすぎます。
- 数値に小数点またはパーセント記号がありません。
生成された写真の事実を確認する方法
コンテンツからビジュアルまでのチェックリストを作成します。
数値の確認
- 項目ごとに元のテキストと比較します。
- 検査ユニット。
- パーセント記号を確認してください。
- 小数点以下の桁を確認してください。
- 時間範囲を確認してください。
- 金額が妥当かどうかを確認してください。
文字の確認
- 製品名のスペル。
- 個人および組織の名前。
- 漢字が変形しているかどうか。
- 判読できない小さな文字があるかどうか。
- 根拠のない結論を追加するかどうか。
構造の確認
- プロセスの方向は正しいですか?
- 分岐条件が逆かどうか。
- 凡例と色が一致しているかどうか。
- 画像が誤った因果関係を示唆しているかどうか。
- キー制約が省略されるかどうか。
生成された画像は、元のデータやテキストの説明の代わりにはなりません。
中国語のインフォグラフィックに関するよくある質問
中国語のビジュアル生成が発生する可能性があります。
- フォントが間違っています。
- 簡素化されたものと伝統的なものの混合。
- 技術識別子は翻訳されます。
- 行間が狭すぎます。
- 句読点と行折り返しの例外。
- 狭い範囲に長文が詰め込まれている。
解決策は、「より鮮明に」を求め続けるのではなく、画像内のテキストを減らすことです。まず、長い文章を 3 語から 6 語のラベルに変更し、説明を本文または図のキャプションに残します。 API 名、ファイル名、およびコマンド パラメーターは、現状のままにするように明示的に要求する必要があります。
管理者が確認する必要があるもの
管理者は以下を確認する必要があります。
- Drive の Gemini for Workspace が有効になっています。
- ユーザーが所属する組織単位によって使用が許可されます。
- Workspace のスマート機能戦略。
- 機能が含まれる予定かどうか。
- データ領域とコンプライアンス要件。
- 外部共有戦略。
- 生成された画像が公開資料に使用できるかどうか。
- 従業員の退職後の文書アクセスの回復。
デフォルトで利用可能な機能は、すべての部門に適しているというわけではありません。契約、医療、法律、未公開の財務データを扱うチームは、まず入力とレビューの境界を確立する必要があります。
Gemini 入力フィールドが表示されない
次の順序で確認してください。
- 必ずウェブ版の Google Docsを使用してください。
- アカウントがサポート プランの一部であるかどうかを確認します。
- ドキュメントに編集権限があり、読み取り専用やコメント権限がないことを確認します。
- Workspace のスマート機能をオンにします。
- 管理者に Drive の Gemini 設定を確認してもらいます。
- 機能がまだ最大 15 日間の段階的ロールアウト期間中かどうかを確認してください。
- 間違った複数の Google アカウントからサインアウトし、再入力してください。
ブラウザのアバターだけを見て個人アカウントかビジネスアカウントかを判断しないでください。書類の右上隅で実際の身元を確認する必要があります。
生成ボタンはありますが、タスクは失敗します
考えられる理由は次のとおりです。
- 文書が長すぎるか、要件の範囲が不明確です。
- 選択されたコンテンツが不十分です。
- リクエストにはサポートされていないコンテンツが含まれています。
- 一時的なネットワークまたはサービスの異常。
- 組織ポリシーによるブロック。
- 一度に多すぎる画像の生成を要求しています。
- 元の画像の形式またはサイズは編集に適していません。
まずは章、画像、明確な目標に絞り込みます。小さなタスクが成功したら、徐々に範囲を増やしてください。
画像は生成されましたが使用できません
一般的な症状と治療法:
| 質問 | プロセス |
|---|---|
| テキストが多すぎます | ラベルを減らし、説明を凡例に移動します |
| 間違った番号 | 明確なテーブルを提供し、新しいデータを禁止する |
| 一貫性のないスタイル | 色、比率、線、図像のルールを書き留める |
| 比率が不適切です | 16:9、4:3、または正方形を指定します |
| 中国語の文字化け | 中国語のラベルを短くし、テキストの説明を保持する |
| コンテンツが切り取られています | 余白を増やし、エッジ要素を減らす |
| 複数の画像に対する用語の違い | 用語集提供後の一括修正 |
画像がプロフェッショナルに見えるからといって、事実確認を省略しないでください。
書き出しと公開前の確認
ドキュメントを PDF や Word にエクスポートしたり、公開して共有したりする前に、次のことを確認してください。
- 画像がさまざまなページ幅で完成するかどうか。
- PDF 内のフォントとラベルは鮮明ですか?
- 伝説が写真と一致するかどうか。
- 白黒で印刷した場合でも色が区別できるかどうか。
- ソースを追加する必要がありますか?
- 著作権またはブランド制限の対象となる要素が含まれているかどうか。
- 内部データの漏洩の有無。
- 代替テキストを提供するかどうか。
出版するときは、生成 AI を真実の情報源ではなく、制作ツールとして扱います。研究、ニュース、医療、金融のコンテンツは特に人間によるレビューが必要です。
アクセシビリティ
写真は色だけで意味を伝えることはできません。提案:
- 画像内でテキスト、図形、またはテクスチャを一緒に使用します。
- 適切な色のコントラストを維持します。
- 小さすぎるフォントは避けてください。
- 画像に代替テキストを追加します。
- 重要な数字と結論を本文に含めてください。
- フローチャートには、対応するテキストのステップが示されています。
スクリーン リーダーは、ピクセル コンテンツのみを含むインフォグラフィックを確実に理解することはできません。アクセシブルなテキスト版は依然として必要です。
ドキュメントのビジュアル生成機能に関する質問
携帯電話でも利用できますか?
公式の現在の説明は Web 側のみをサポートしています。モバイル端末で閲覧できる文書であっても、作成と一括編集の入り口が同じであるわけではありません。
データを自動的に正確なグラフに変換できますか?
視覚的な表現を生成できますが、正確なデータは検証可能なテーブルから得られる必要があります。正式なレポートの場合は、元のデータとグラフ作成の基礎を保持することをお勧めします。
複数の画像を一度に変更できますか?
一括作成や編集依頼も可能です。まず統一ルールを定義し、番号、ラベル、章の対応を一つ一つ確認していきます。
文書全体が読まれるでしょうか?
ドキュメントコンテキストを使用できます。一部のみを処理したい場合は、コンテンツを選択してプロンプト内でスコープを設定し、生成に含めるべきではない機密情報を削除する必要があります。
生成ビジュアルを実用的に仕上げる
Gemini は、ドキュメント内にビジュアル コンテンツを生成します。これは、「テキストは完成しているが、明確な図が欠けている」という問題の解決に最適です。安定した結果を得るには、一度だけ美しい画像を生成することだけを追求してはなりません。より信頼性の高いプロセスは次のとおりです。
- まず文書の構造とデータを整理します。
- 生成範囲を制限します。
- 比率、対象者、視覚的基準を明確にする。
- 事実とテキストを項目ごとに確認します。
- バージョン履歴を使用してバッチ変更のリスクを制御します。
- 公開する前に、アクセシビリティに関するメモとソースを補足します。
この方法で生成された画像は、検証できない装飾的な画像ではなく、文書の内容を確実に表現したものです。