Tags
33 个页面
本地大模型
Bonsai Windows 本地运行教程:1-bit 模型、视觉与 MCP 工具调用
CMP 170HX 解锁 80GB 显存靠谱吗?AI 矿卡购买风险与验证清单
Ollama OpenClaw 怎么本地部署:模型选择、端口、权限与记忆插件排错
本地大模型 API 给 Codex 使用教程:Ollama、LM Studio 和 vLLM
Codex 本地大模型接入 Ollama 常见报错:教程、排障和 FAQ
Qwythos-9B 怎么用?vLLM、SGLang 和 Transformers 部署指南
GLM 5.2 开源:百万上下文、Agent 编程与本地部署门槛
OpenAI Codex 重大更新:现在可以接入 Ollama、LM Studio 等本地大模型
Holo 3.1 本地部署教程:用 llama.cpp 接入 OpenClaw 跑 Computer Use Agent
Headroom 使用教程:给 Claude Code、Codex 和 AI Agent 省上下文
Gemma 4 12B 能在本地跑吗?16GB 电脑试用与上手思路
Ollama 接入 Codex App:本地大模型如何变成 AI 编程 Agent
RTX 3060 也能跑 35B?llama.cpp 的 --n-cpu-moe 让老电脑继续本地大模型
Qwen3.6-35B-A3B 本地部署:GGUF、llama.cpp、显存与 API 验证
RTX 3070 8GB 本地运行 Qwen3.6-35B:llama.cpp 部署要点与优化参数
本地运行 DeepSeek 4:Antirez ds4 在 Apple Silicon Mac 上的尝试
llama.cpp 多 GPU 性能实测思路:2x V100 16GB 会比单卡 32GB 快吗?
RTX 5090 / 5080 AI 推理性能实测:本地大模型、4K 视频生成和实时 3D 怎么选
RTX 3060 12GB 本地大模型推荐:量化、上下文与实测选型
Qwen3.6 本地部署显存:27B 与 35B-A3B 量化估算和实测方法
DeepSeek V4 本地部署可行性:Pro 与 Flash 参数、内存估算和 API 选择
Gemma 4 本地部署显存:E2B、E4B、12B、26B 与 31B 怎么选
8G 显存跑 llama.cpp 怎么调:32K 更稳,64K 要开 KV Cache 量化
16G 显卡也能跑 35B 模型:LM Studio 下 MoE 模型的显存压缩思路
Ollama 多显卡使用笔记:显存叠加、GPU 选择和常见误区
Gemma 4 E4B 第三方衍生版可靠吗?模型来源与对比方法
Windows 局域网访问 Ollama API 设置指南
Gemma 4 本地调用指南:从一键运行到开发集成
Ollama 云模型是什么,怎么用
从 Hugging Face 下载 GGUF 模型并导入 Ollama
Ollama pull 下载慢怎么排查:DNS、代理、TLS、磁盘与缓存恢复
树莓派 5 跑 Gemma 4:部署边界与复测方法
Android 上安装并运行 Gemma 4:完整上手指南