恒美微站 Logo 恒美微站
  • 首页
  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心
  • 联系我们

如何把多台 Mac 拼成 AI 推理集群:Exo 完整部署指南

  • 首页
  • 资讯中心
  • /
  • 如何把多台 Mac 拼成 AI 推理集群:Exo 完整部署指南

相关资讯

让BT下载提速3倍:78个每日更新的公共Tracker完整配置指南 2026/8/31 8:18:28
Vorssaint快捷面板:常用工具一键直达的macOS新手完整教程 2026/8/31 8:18:28
双向链接笔记指南:快速搭建你的个人知识网络 2026/8/31 8:18:28

最新资讯

2 位量化也能可靠推理吗?DwarfStar 如何保证 IQ2_XXS 模型的质量
用Python写一个自动跟随Codex窗口的悬浮小工具
VMware Workstation 虚拟机安装系统教程:从下载到报错排查全攻略
异环残虹好感度400攻略:道具性价比与资源规划实战
昇腾集群强化学习训推一体加速:异步流水调度与通信优化实践
开放Agent Web与GEA:构建可被智能代理发现和调用的服务入口

今日推荐

MCU无DAC如何用定时器+DMA 2D输出高保真任意波形
Cortex-M3 Flash下载失败?从编程错误标志到供电瞬态排查
STM32 TouchGFX屏幕切换Transition优化:原理、配置与排障实战

本周热门

备战数据库管理工程师校招:索引、事务、备份恢复核心考点解析
数字电路时序基石:深入理解建立时间与保持时间
蓝桥杯国赛超声波测距机:从单片机原理到嵌入式系统实战

本月精选

如何用DamaiHelper实现演唱会门票的智能自动化抢购:完整技术解决方案指南
第4篇:59 倍性能差距的索引瓶颈定位——一次教科书级的全表扫描调优
终极歌词批量下载神器:5分钟解决离线音乐库歌词同步难题

如何把多台 Mac 拼成 AI 推理集群:Exo 完整部署指南

发布时间:2026/8/31 8:18:28
如何把多台 Mac 拼成 AI 推理集群:Exo 完整部署指南 如何把多台 Mac 拼成 AI 推理集群Exo 完整部署指南【免费下载链接】exoRun frontier AI locally.项目地址: https://gitcode.com/GitHub_Trending/exo8/exo目标模型装不进单机显存时常规解法是买一台更贵的服务器但桌面已有的机器可能就够了。Exo 是一个把多台现有设备拼成一个 AI 集群的分布式推理工具节点自动互相发现模型自动切分到各台机器设备越多推理越快。30 秒启动集群环境依赖一句话带过装好 uv、node 和 Rust 工具链即可macOS 上编译 MLX 还需要 Xcode。然后是三行单行命令git clone https://gitcode.com/GitHub_Trending/exo8/exocd exo/dashboard npm install npm run builduv run exo起来之后浏览器打开http://localhost:52415同一个页面既是管理面板也是 API 入口。集群里任意一台节点都能作为入口看到的状态是一致的。Exo 替你干了哪些活节点自动发现零地址配置同一局域网里的机器装好 exo 后会自动发现彼此不需要注册、填地址或指定主从。某台机器掉线或重启时集群通过分布式算法重新选出 master 并自动恢复相关逻辑在 src/exo/shared/election.py 里。切分方案自动算不用管哪层放哪台机器创建实例前你可以先用 /instance/previews 预览所有可行的切分方案系统会依据每台机器的空闲内存、当前负载和各条链路的实际带宽与延迟来选最优解核心逻辑在 src/exo/master/placement.py。开启张量并行后双机集群比单机快 1.8 倍四机可到 3.2 倍。RDMA 让机器间通信接近免费分布式推理最大的开销通常在机器之间的数据搬运。macOS 26.2 配合雷雳 5在恢复模式执行一次rdma_ctl enable后重启设备间延迟可降约 99%。实测数据4 台 M3 Ultra Mac Studio 跑 Qwen3-235B 达到 31.9 tokens/s而单机方案只有 20.4 tokens/s 左右。跑通之后只需要盯三件事线材和系统版本。用 RDMA 时所有节点必须用 TB5 线缆物理互联Mac Studio 上紧邻网口的雷雳口不能用且各台系统版本要完全一致连 beta 编号都不能差否则 RDMA 端口互相发现不了。集群隔离。同一网络跑多个 exo 集群时给每个集群设不同的EXO_LIBP2P_NAMESPACE环境变量避免节点串网只跑一个集群可以忽略这条。接入现有工具。API 兼容 OpenAI Chat Completions、Claude Messages 和 Ollama 三种协议客户端把请求地址指到 52415 端口就能直接用全部端点细节见 docs/api.md想验证切分方案的性能跑一下自带的 bench/exo_bench.py 即可。谁适合用 / 谁不适合适合你的场景手头有几台 Apple Silicon 机器尤其是带雷雳 5 的型号想本地跑 200B 以上开源模型的推理希望现有 OpenAI 兼容客户端和脚本不改动就能接入它解决不了的问题Linux 上目前是纯 CPU 运行没有 GPU 加速RDMA 需要雷雳物理互联普通局域网只能走较慢的常规分布式推理只做推理不承担训练任务如果你现在手里的资产就是几台 M 系列 Mac 加一个放不下单机的模型值得花半天用 exo 搭个测试集群部署成本远低于重新采购硬件。【免费下载链接】exoRun frontier AI locally.项目地址: https://gitcode.com/GitHub_Trending/exo8/exo创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于恒美微站

恒美微站专注于为个体商户、工作室提供极简自助建站服务,让每个人都能轻松拥有专业网站。

快速链接

  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心

服务项目

  • 可视化建站
  • 拖拽编辑
  • 主题定制
  • SEO 优化
  • 网站托管

联系方式

  • 📍 地址:北京市朝阳区建国路 88 号
  • 📞 电话:400-888-8888
  • ✉️ 邮箱:info@hmyw.cn
  • 🕐 时间:周一至周日 9:00-18:00

© 2024 恒美微站 hmyw.cn 版权所有 | 京 ICP 备 12345678 号