本地跑大模型全套工具

从"我的显卡能跑什么模型"到"量化怎么选、微调要多少显存、API 和本地哪个划算",本地部署大模型全流程需要的工具都在这里。

适合:想在自己电脑上跑 Ollama / 本地大模型的开发者和爱好者

推荐工作流

  1. 1

    用 GPU 检测工具识别显卡与可用显存,拿到能流畅运行的模型清单与推荐量化档位

  2. 2

    按检测报告的量化建议安装对应 GGUF 模型(Ollama / LM Studio 均可)

  3. 3

    纠结本地还是云端时,用 Token 成本计算器按你的调用量对比电费与 API 账单

  4. 4

    想微调自己的数据,先用 LoRA 显存计算器确认显存预算,再选 LoRA 或 QLoRA 方案

  5. 5

    把验证过效果的提示词存进提示词库,模板化高频任务

检测显卡型号、显存与WebGPU支持,推荐电脑能流畅运行的本地大模型及GGUF量化版本

使用: 2.0k+ 打开

估算文本Token数量,对比GPT/Claude/DeepSeek等模型API价格与本地推理电费成本

使用: 1.8k+ 打开

估算全参/LoRA/QLoRA微调所需显存,按批大小与序列长度给出显存账单与显卡建议

使用: 900 打开

写作/编程/翻译/学习/办公五类提示词模板,变量占位填充,支持自定义与导入导出

使用: 1.3k+ 打开

#本地跑大模型全套工具:一套解决完整任务的工具组合

从"我的显卡能跑什么模型"到"量化怎么选、微调要多少显存、API 和本地哪个划算",本地部署大模型全流程需要的工具都在这里。本专题面向想在自己电脑上跑 Ollama / 本地大模型的开发者和爱好者,精选了 4 个本地跑大模型工具场景下的高频工具。

所有工具均为纯本地计算:本地跑大模型全套工具中的每一个工具都在浏览器内完成处理,想在自己电脑上跑 Ollama / 本地大模型的开发者和爱好者无需注册、无需上传任何数据。建议按上方工作流的顺序使用,每个环节的输出即为下一环节的输入。

相关工具推荐

暂无相关工具推荐

您可以浏览更多分类发现其他实用工具