news 2026/8/2 3:50:46

RK3588 板端离线部署 Ollama + Qwen3:0.6B

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
RK3588 板端离线部署 Ollama + Qwen3:0.6B

RK3588 板端离线部署 Ollama + Qwen3:0.6B

(Ubuntu 24.04 / aarch64 / systemd)

适用于 RK3588 / RK3568 等64 位 ARM(aarch64)板卡
适合离线 / 内网环境


1️ 确认系统架构与系统版本

1.1 确认 CPU 架构

uname-m

期望输出:

aarch64

若不是aarch64,请不要继续,Ollama 二进制将无法运行,请选择对应的版本。


1.2 确认系统版本

cat/etc/os-release|head

示例输出:

PRETTY_NAME="Ubuntu 24.04.3 LTS" VERSION="24.04.3 LTS (Noble Numbat)" VERSION_CODENAME=noble
结论:
  • 架构:aarch64(64 位 ARM)
  • 系统:Ubuntu 24.04 LTS
  • 需要使用ollama-linux-arm64.tgz

2️ 准备:下载并放置 Ollama 安装包

2.1 下载 Ollama(ARM64 版本)

注意:不要下载 amd64 版本

curl-fL-oollama-linux-arm64.tgz\https://ollama.com/download/ollama-linux-arm64.tgz
  • 文件大小约2 GB
  • 离线环境可在其他机器下载后拷贝到板子
  • 在浏览器可以点击https://ollama.com/download/ollama-linux-arm64.tgz
    下载,再移动到板端对应目录。

2.2 创建目录并放置安装包

mkdir-p~/llmcd~/llmls-lh

确认能看到:

ollama-linux-arm64.tgz

3️ 安装 Ollama(二进制方式)

3.1 解压到系统目录/usr

cd~/llmsudotar-zxvfollama-linux-arm64.tgz-C/usr

3.2 校验 Ollama 是否可执行

ls-l/usr/bin/ollama /usr/bin/ollama--version

若看到版本号输出,说明二进制正常


4️ 配置 systemd 服务(开机自启)

4.1 创建服务文件

sudovim/etc/systemd/system/ollama.service

填入以下内容:

[Unit] Description=Ollama Service After=network-online.target Wants=network-online.target [Service] Type=simple ExecStart=/usr/bin/ollama serve User=pi #替换为你的用户名 Group=adm #替换为你的用户组 Restart=always RestartSec=3 Environment=PATH=/usr/bin:/usr/local/bin [Install] WantedBy=multi-user.target

说明:

  • User=pi:请确认该用户存在(RK 官方镜像通常为 pi)
  • 若使用root,可改为User=root

4.2 启动并设置开机自启

sudosystemctl daemon-reloadsudosystemctlenable--nowollama

4.3 确认服务状态

systemctl status ollama

看到Active: active (running)即成功。


5️ 拉取并运行 Qwen3:0.6B(CPU 可跑)

5.1 拉模型

ollama pull qwen3:0.6b

首次拉取需联网
离线环境可提前在其他机器下载模型目录再拷贝


5.2 运行模型(交互模式)

ollama run qwen3:0.6b

进入交互后可直接对话,退出方式:

Ctrl + D

6 参考文献

  • https://docs.ollama.com/linux#manual-install
  • http://githubgithub.com/ollama/ollama
版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/7/26 1:44:36

start_app.sh脚本解读:GLM-TTS启动背后的自动化逻辑

start_app.sh 脚本解读:GLM-TTS 启动背后的自动化逻辑 在当前 AI 应用快速落地的浪潮中,一个看似简单的 .sh 文件,往往承载着从实验室原型到可运行服务的关键一跃。以 GLM-TTS 为例,这个支持零样本语音克隆、情感迁移和方言合成的…

作者头像 李华
网站建设 2026/7/28 7:33:55

GLM-TTS显存占用过高怎么办?显存清理与优化策略

GLM-TTS显存占用过高怎么办?显存清理与优化策略 在部署新一代语音合成系统时,不少开发者都遇到过这样的尴尬:刚跑完一段语音,显存就飙升到90%以上;再试一次,直接报错“CUDA out of memory”。尤其是使用像 …

作者头像 李华
网站建设 2026/7/28 19:02:18

B站视频脚本创作:用图文+语音形式介绍GLM-TTS功能

GLM-TTS:让AI为你“开口说话”的零样本语音克隆利器 你有没有遇到过这种情况——写好了视频脚本,却迟迟不敢配音?要么嫌自己声音不够专业,要么录了一遍又一遍,剪辑时发现读错了一个字又要重来。更别提改稿后整段重录的…

作者头像 李华
网站建设 2026/7/28 14:29:30

基于Spring Boot的短信服务系统的设计与实现vue

目录短信服务系统摘要关于博主开发技术介绍核心代码参考示例1.建立用户稀疏矩阵,用于用户相似度计算【相似度矩阵】2.计算目标用户与其他用户的相似度系统测试总结源码文档获取/同行可拿货,招校园代理 :文章底部获取博主联系方式!短信服务系统…

作者头像 李华
网站建设 2026/7/28 11:14:20

面试必杀:详细描述 LangGraph 中的 `State` 究竟是如何通过 `Reducers` 实现从‘时间点 A’平滑迁移到‘时间点 B’的?

在构建复杂的人工智能系统,特别是需要多步骤推理、工具使用和记忆的智能体时,核心挑战之一是如何有效地管理和维护系统的内部状态。传统的无状态API调用难以支撑这类需求,因为智能体需要“记住”之前的对话、行动结果,并根据这些信…

作者头像 李华