Tags
第 30 頁
本地大模型
Bonsai Windows 本地執行教程:1-bit 模型、視覺與 MCP 工具呼叫
CMP 170HX 解鎖 80GB 顯示記憶體可靠嗎?AI 礦卡購買風險與驗證清單
Ollama OpenClaw 怎麼本地部署:模型選擇、端口、權限與記憶插件排錯
本地大模型 API 給 Codex 使用教程:Ollama、LM Studio 和 vLLM
Codex 本地大模型接入 Ollama 常見報錯:教程、排障和 FAQ
Qwythos-9B 怎麼用?vLLM、SGLang 和 Transformers 部署指南
OpenAI Codex 重大更新:現在可以接入 Ollama、LM Studio 等本地大模型
Holo 3.1 本地部署教程:用 llama.cpp 接入 OpenClaw 跑 Computer Use Agent
Headroom 使用教程:給 Claude Code、Codex 和 AI Agent 省上下文
Gemma 4 12B 能在本地跑嗎?16GB 電腦試用與上手思路
Ollama 接入 Codex App:本地大模型如何變成 AI 編程 Agent
Qwen3.6-35B-A3B 本地部署:GGUF、llama.cpp、顯存與 API 驗證
本地執行 DeepSeek 4:Antirez ds4 在 Apple Silicon Mac 上的嘗試
llama.cpp 多 GPU 性能實測思路:2x V100 16GB 會比單卡 32GB 快嗎?
RTX 5090 / 5080 AI 推理效能實測:本地大模型、4K 影片生成和即時 3D 怎麼選
RTX 3060 12GB 本地大模型推薦:量化、上下文與實測選型
Qwen3.6 本地部署顯存:27B 與 35B-A3B 量化估算和實測方法
DeepSeek V4 本地部署可行性:Pro 與 Flash 參數、記憶體估算和 API 選擇
Gemma 4 本地部署顯存:E2B、E4B、12B、26B 與 31B 怎麼選
8G 顯存跑 llama.cpp 怎麼調:32K 更穩,64K 要開 KV Cache 量化
16G 顯卡也能跑 35B 模型:LM Studio 下 MoE 模型的顯存壓縮思路
Ollama 多顯卡使用筆記:顯存疊加、GPU 選擇和常見誤區
Gemma 4 E4B 第三方衍生版可靠嗎?模型來源與對比方法
Windows 區域網存取 Ollama API 設定指南
Gemma 4 本地調用指南:從一鍵啟動到開發整合
Ollama 雲模型是什麼,怎麼用
從 Hugging Face 下載 GGUF 模型並匯入 Ollama
Ollama pull 下載慢怎麼排查:DNS、代理、TLS、磁碟與快取恢復
樹莓派 5 跑 Gemma 4:部署邊界與可復測方法
Android 上安裝並運行 Gemma 4:完整上手指南