项目分享|在家搭建AI集群：exo让普通设备也能跑大模型-开发者社区

引言

随着大模型参数规模不断提升，单台设备的显存、算力瓶颈成为普通开发者部署大模型的核心障碍——要么模型因显存不足无法运行，要么推理速度极慢。而exo项目的出现解决了这一痛点：它能将日常设备（如Mac Studio、MacBook）连接成一个AI集群，不仅能运行远超单设备显存容量的大模型，还能通过RDMA等技术大幅提升推理速度，让个人用户也能低成本搭建专属AI集群。

项目核心定位与功能

exo是一款面向个人用户的AI集群管理工具，核心目标是让普通人用日常设备搭建分布式AI集群，轻松运行超大参数量的大模型。

它的核心功能覆盖集群全生命周期：设备层面支持自动发现，无需手动配置即可让多台设备组建集群；模型运行层面支持张量并行，能将大模型分片部署到多台设备上，实测在4台M3 Ultra Mac Studio组成的集群中，可流畅运行Qwen3-235B、DeepSeek v3.1 671B、Kimi K2 Thinking等超大模型；此外，exo还提供可视化仪表盘和OpenAI兼容的API，降低集群使用门槛。

核心创新点与优势

exo能突破单设备限制，核心源于四大关键创新与优势：

自动设备发现：集群内设备无需手动配置，启动exo后自动识别彼此，降低集群搭建门槛；
RDMA over Thunderbolt 5支持：原生支持RDMA（远程直接内存访问），可将设备间通信延迟降低99%，这也是exo相比传统分布式框架的核心优势；
拓扑感知自动并行：实时感知设备拓扑结构，结合设备资源、网络带宽/延迟动态规划模型分片策略，最大化集群效率；
张量并行提速：支持模型分片部署，实测2台设备可实现1.8倍提速，4台设备达3.2倍；
MLX生态适配：基于MLX（苹果生态高效推理框架）和MLX distributed做分布式通信，适配Apple Silicon硬件特性，性能更优。

部署与技术实践

1. 环境部署（分系统）

macOS部署（从源码运行）

先安装依赖：

# 安装brew/bin/bash -c"$(curl-fsSL https://raw.githubusercontent.com/Homebrew/install/HEAD/install.sh)"# 安装uv、macmon、nodebrewinstalluv macmonnode# 安装Rust（nightly版本）curl--proto'=https'--tlsv1.2 -sSf https://sh.rustup.rs|shrustup toolchaininstallnightly

再克隆代码并运行：

# 克隆仓库gitclone https://github.com/exo-explore/exo# 构建仪表盘cdexo/dashboard&&npminstall&&npmrun build&&cd..# 启动exouv run exo

启动后可访问http://localhost:52415查看仪表盘和API。

Linux部署（从源码运行）

以Ubuntu/Debian为例安装依赖：

# 安装Node.js和npmsudoaptupdatesudoaptinstallnodejsnpm# 安装uvcurl-LsSf https://astral.sh/uv/install.sh|sh# 安装Rust（nightly版本）curl--proto'=https'--tlsv1.2 -sSf https://sh.rustup.rs|shrustup toolchaininstallnightly

克隆代码并运行（步骤同macOS，无需安装macmon）：

gitclone https://github.com/exo-explore/exocdexo/dashboard&&npminstall&&npmrun build&&cd..uv run exo

2. 启用RDMA（macOS）

RDMA是exo高性能的核心，需在macOS 26.2+（Thunderbolt 5设备）中启用：

关闭Mac，长按电源键10秒进入启动菜单；
选择“Options”进入恢复模式，打开“实用工具”→“终端”；
执行命令启用RDMA：rdma_ctl enable；
重启Mac即可。

3. API使用示例

预览模型部署方案

curl"http://localhost:52415/instance/previews?model_id=llama-3.2-1b"

创建模型实例

curl-X POST http://localhost:52415/instance\-H'Content-Type: application/json'\-d'{ "instance": {...} # 替换为预览接口返回的instance内容 }'

发送聊天补全请求（兼容OpenAI API）

curl-N -X POST http://localhost:52415/v1/chat/completions\-H'Content-Type: application/json'\-d'{ "model": "mlx-community/Llama-3.2-1B-Instruct-4bit", "messages": [ {"role": "user", "content": "What is Llama 3.2 1B?"} ], "stream": true }'

删除模型实例

curl-X DELETE http://localhost:52415/instance/YOUR_INSTANCE_ID

该项目及相关内容已 AladdinEdu课题广场同步发布，欢迎前往了解更多技术实现与资源。

项目地址：AladdinEdu课题广场

**AI漫剧软件2025推荐，解锁海量免费资源与智能创作体验

AI漫剧软件2025推荐，解锁海量免费资源与智能创作体验据《2025中国数字内容产业白皮书》显示，2025年AI生成视频内容的市场规模预计突破800亿元，其中AI漫剧作为新兴赛道，用户需求同比增长超过300%。然而，行业报告同时指出…

李华

想转行网络安全不知道从哪学？这 5 个核心技能优先掌握，轻松打通入门路径

引言很多转行同学刚接触网络安全，面对 “渗透测试”“逆向工程”“云安全” 等一堆技能，不知道先学哪个。本文总结 5 个 “最优先” 的核心技能 —— 学会这 5 个，能应对 80% 的入门级岗位需求，帮你快速搭建学习框架。一、核心…

李华

强推！2026 年 IT 运维转网络安全全栈：保姆级学习路线图，助力高薪转型就业

一、转型核心优势分析技能复用矩阵 • 网络基础：TCP/IP、VLAN、路由协议 → 安全组策略、流量分析• 系统管理：Linux/Windows运维 → 漏洞修补、权限管控• 自动化能力：Shell/Python脚本 → 渗透工具开发、日志分析• 云平台经验&#xff1…

李华

关于文献综述写作的一些想法

最近又写完一篇，分享一点不成体系的碎片化的经验。 1 构思和写作之前，一定要想清楚读者是谁。系统性文献综述（期刊上那种），开题前写的文献综述，作为论文章节的一部分的文献综述，思路是完全不同的…

李华

高考志愿填报：该不该选择网络安全专业？

志愿填报 | 网络空间安全专业怎么样？ 高考成绩一出，距离填志愿的日子就不远了。对于很多朋友估计很迷茫，不知道这些专业是干什么的，要学什么，毕业后前景怎么样，能干什么工作。咱们这个号主要讲网络安全…

李华

好写作AI：期刊审稿政策对AI辅助写作的接纳度与风险防控

从“全面禁止”到“有条件开放”：期刊政策的转型期当研究者按下论文投稿按钮的瞬间，一个关乎稿件命运的新问题日益凸显：期刊的审稿政策，如何审视文中AI参与的痕迹？ 从早期部分期刊的“零容忍”禁令，到如今越…

李华