Roo Code 离线模式快速上手指南:Ollama 本地模型 + 断网编程 5 分钟配齐
【免费下载链接】Roo-CodeRoo Code gives you a whole dev team of AI agents in your code editor.项目地址: https://gitcode.com/GitHub_Trending/ro/Roo-Code
高铁过隧道、酒店 Wi-Fi 抽风,屏幕右下角的网络图标又灰了。把本地模型跑起来之后,Roo Code 的离线模式照样能在编辑器里读代码、改文件、答问题——AI 编程助手第一次不依赖云端。
快速上手:本地模型 + Roo Code 三步跑通
装好之后,Roo Code 里的代码生成、文件编辑、终端命令等全部照常可用。全程只在第一次拉模型时需要联网,之后断网也不受影响。
5 分钟装好 Ollama 本地推理环境
Ollama 是一个在电脑本地运行大模型的命令行工具,可以理解成"AI 模型播放器":把模型文件放进来,它就在本机提供推理服务。从 Ollama 官网下载对应系统的安装包,按向导装完即可。安装完成后服务默认监听http://localhost:11434,Roo Code 会用这个地址连接。嫌命令行麻烦的话,也可以选 LM Studio:它提供图形界面,默认端口是 1234。
选一个"支持工具调用"的模型
这点比参数量更重要。Roo Code 靠"工具调用"读写文件、执行命令,不支持这个能力的模型会被自动过滤,下拉列表里根本看不到它。下载模型只需一条命令:ollama pull qwen2.5-coder:7b。16GB 显存可以上qwen2.5-coder:32b;只有 8GB 显存,7B 更稳妥。
在 Roo Code 里选中 ollama 这个 Provider
打开 Roo Code 侧边栏,点齿轮进设置,把 API Provider 选成ollama,模型名填上一步拉取时的名字。Base URL 保持默认即可;如果 Ollama 跑在别的机器上,再把地址改过去。填完保存,模型列表会从本地服务自动读出来。
它是怎么做到离线的
离线的秘密其实就两根支柱,都不神秘。
第一根是本地推理。Roo Code 把对话请求直接发给本机的 Ollama,不经过任何云端 API,源码在 src/api/providers/native-ollama.ts,连不上时它会明确报出地址让你排查。第二根是本地项目索引。Roo Code 的"代码库索引"功能在本机把你的项目切成片段并建立向量索引,实现位于 src/services/code-index/。索引建好后,断网时模型仍能"检索"到相关代码片段,上下文不缺斤少两。
一句话总结:模型在本地跑,索引在本地存,断网只剩速度损失,没有功能损失。
断网时你能干成的 3 件事
写代码和改文件
本地模型支持 Roo Code 的原生工具调用,所以它不只会"说",还能"做":读文件、改代码、跑命令。在 Chat 面板里直接说"把这个函数加上错误处理",它会定位、修改、验证,和在云端模型下没有流程差别。区别只是响应速度,取决于你的显卡。
给项目做一次离线体检
先在有网时建好代码库索引,之后断网照样能问。比如"这个模块里有没有潜在的空指针问题",模型会检索到相关文件再分析。对旅途中 review 代码、或者机房临时断网时的紧急排查,这条链路非常实用。
顺手补文档
"给这个类写注释""根据代码生成 API 说明"这类活,交给本地模型就够。生成的文档格式和在线时一致,只是措辞质量取决于模型本身——这是所有本地模型的共性,不是配置问题。
让它更快:固定上下文 + 预加载
本地模型跑不快,多半不是显卡不行,而是上下文没固定。第一次请求时 Ollama 会冷启动加载模型,此时如果上下文窗口没设上限,它可能按默认最大值申请内存,直接把显存撑爆。官方文档(apps/docs/docs/providers/ollama.md)建议用 Modelfile 把num_ctx钉死:
FROM qwen2.5-coder:32b PARAMETER num_ctx 32768然后ollama create my-model -f Modelfile。Roo Code 会自动读取这个配置,你不需要在它里面再设一次。经验值:8GB 显存配 16384,16GB 配 32768。另外,先ollama run把模型提前加载并保持在运行状态,Roo Code 发请求时就是热的,首条回复的等待时间能省掉大半。
常见卡点排查
现象:报错 "Ollama service is not running at http://localhost:11434"。检查:ollama ps看服务是否在跑。解决:先启动服务,或把 Roo Code 里的 Base URL 改成实际地址和端口。
现象:Provider 选了 ollama,模型下拉列表却是空的。检查:ollama list里模型名是否支持 tools 能力,Roo Code 会把不支持的静默过滤掉。解决:换一个支持工具调用的模型。
现象:第一次请求 OOM(内存不足),之后手动启动模型又好了。检查:是否固定了num_ctx、是否提前加载。解决:按上一节用 Modelfile 钉死上下文,并保持模型常驻。
现在就动手
打开终端装好 Ollama,ollama pull一个支持工具调用的编码模型,在 Roo Code 设置里把 Provider 切成 ollama——三步,不超过 5 分钟。然后做一件事:拔掉网线,发一条消息。如果模型照常回复,你的离线编程环境就算真正成立了。
【免费下载链接】Roo-CodeRoo Code gives you a whole dev team of AI agents in your code editor.项目地址: https://gitcode.com/GitHub_Trending/ro/Roo-Code
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考