发布时间:2026/8/31 13:13:33
用4台Mac Studio跑671B大模型:exo本地AI集群部署指南 用4台Mac Studio跑671B大模型exo本地AI集群部署指南【免费下载链接】exoRun frontier AI locally.项目地址: https://gitcode.com/GitHub_Trending/exo8/exoexo把多台Mac和Linux机器组成一个本地AI集群自动把大模型切分到各台机器上推理。适合拥有两台以上Apple Silicon设备、想在家里部署200B以上参数模型的人。解决什么问题单机装不下传统多机越加越慢最直观的问题是显存DeepSeek V3.1 671B8-bit权重超过600GB任何单台消费级设备都装不下。但多机TCP的老办法是个坑——机器加得越多反而越慢。仓库基准里llama.cppTCP从单机的20.4 t/s掉到4机的15.2 t/sexo走雷雳RDMA后方向反过来从单机19.5 t/s升到4机31.9 t/s。上手体验macOS应用一分钟源码三步macOS上最短的路径是直接装官方应用需要macOS Tahoe 26.2或更高brew install --cask exo应用会请求修改系统设置并安装一个网络配置描述文件允许即可。同一网络上的其他机器会自动互相发现、加入集群不需要手动填地址。走源码则是固定三步克隆仓库、构建dashboard、启动git clone https://gitcode.com/GitHub_Trending/exo8/exo cd exo/dashboard npm install npm run build cd .. uv run exo启动后浏览器打开http://localhost:52415仪表盘和API都在这直接建模型实例就能对话。API细节在 docs/api.md。看懂内部结构谁负责推理谁负责切分内部分工是两层。每台机器上跑一个workersrc/exo/worker/ 下的MLX引擎负责推理其中 auto_parallel 会根据实时拓扑图结合每台机器的剩余显存和每条链路的带宽自动算出模型怎么切src/exo/master/ 负责集群协调和模型放置决策。这就是仪表盘里看到的拓扑图每条虚线是两台机器之间的物理链路图上直接标注了显存占用、温度和功耗。数据验证RDMA比TCP快多少以下数字来自仓库内置的4× M3 Ultra Mac Studio512GB 雷雳5全互联、Tensor Parallel配置下的实测Jeff Geerling的测试对比对象是llama.cppTCPQwen3 235B A22B4节点exo 31.9 t/sllama.cpp 15.2 t/sDeepSeek V3.1 671B4节点exo 32.5 t/sllama.cpp 14.6 t/sKimi K2 Thinking 1T A32B4节点exo 28.3 t/sllama.cpp 16.4 t/s注意一个细节单机时exo21.1略慢于llama.cpp14.8除外此处以4节点为准优势主要体现在多机扩展上——节点越多与TCP的差距越大而不是勉强能跑。常见坑位与快速排查RDMA集群的3个高频问题节点互相发现不了多半是macOS版本不一致RDMA要求所有设备版本完全相同连beta编号都要一样另外确认已在恢复模式终端执行过 rdma_ctl enable 并重启仅macOS 26.2及以上支持。Mac Studio可用端口少紧邻网口的那个雷雳5口不能用于RDMA线缆必须是TB5规格且集群成员要两两直连的全互联拓扑星型接法不行。Linux用户期待GPU加速exo目前在Linux上只跑CPUGPU支持还在开发中等不急的先上macOS。它适合谁有边界的选型建议适合手里有两台以上Apple Silicon设备尤其带雷雳5的M4 Pro/Max、M3 Ultra、想本地跑前沿大模型、又不想采购GPU服务器的人API兼容OpenAI Chat Completions、Claude Messages和Ollama格式接现有客户端基本零改造。不适合只有一台机器组不了集群需要Linux上NVIDIA GPU推理的暂只跑CPU打算用普通千兆交换机组网就期待RDMA性能的——RDMA必须TB5线缆直连。先跑一台机器把流程走通确认localhost:52415能出字再接入第二台看它出现在拓扑图里。想自己复现上面的数字仓库自带压测工具测试方法写在 bench/METHODOLOGY.md。【免费下载链接】exoRun frontier AI locally.项目地址: https://gitcode.com/GitHub_Trending/exo8/exo创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

2026/8/31 13:13:33

Matlab雷达干扰样式仿真:从原理到代码实现与调试

简介:本资源是一套面向雷达系统设计与电子对抗研究者的MATLAB仿真工具集,聚焦于典型雷达干扰样式的建模与效果分析,适用于高校通信/雷达方向研究生、电子战领域工程师及信号处理初学者开展抗干扰算法验证与教学实验。压缩包共9个文件&#xf…

2026/8/31 13:13:33

MATLAB磨削与挤压热力耦合仿真建模及参数优化实战

简介:本资源是一份面向机械制造、精密加工及先进制造领域研究生与工程师的MATLAB仿真工具包,聚焦单颗磨粒尺度下的磨削区建模与挤压过程动态分析,解决磨削机理研究中磨削区形状演化规律难以直观量化、工艺参数影响机制不明确等核心问题。压缩…

2026/8/31 13:13:33

Gym到Gymnasium迁移实战:API差异与踩坑指南

简介:本资源是面向强化学习开发者与研究者的Gymnasium迁移实践指南,专为熟悉OpenAI Gym但需平滑过渡至新标准框架的Python工程师设计,解决API变更、环境重构与项目适配等核心迁移难题。压缩包共301个文件(1.81MB)&…

2026/8/31 13:23:34

开源AI Agent测试Web应用:原理、实践与工程落地

1. 为什么 Web 测试需要 AI Agent如果你写过一段时间的 Web 自动化测试,大概会遇到这些让人头疼的场景:页面结构一变,之前的 XPath、CSS 选择器全部失效,测试代码跟着一起“重构”。登录、下单、权限校验这类跨页面流程&#xff0…

2026/8/31 13:23:34

30 分钟跑通 LocalAI:本地部署第一个 OpenAI 兼容大模型

30 分钟跑通 LocalAI:本地部署第一个 OpenAI 兼容大模型 【免费下载链接】LocalAI LocalAI is the open-source AI engine. Run any model - LLMs, vision, voice, image, video - on any hardware. No GPU required. 项目地址: https://gitcode.com/GitHub_Trend…

2026/8/31 13:23:34

HyperMesh 2019视频教程:从几何清理到网格划分的完整前处理主线

很多人收藏了一堆 HyperMesh 2019 视频教程,真正打开软件面对一个实际问题时,却依然不知道第一步该做什么。这不是学习态度的问题,而是学习方式的问题。HyperMesh 这类前处理工具,操作面板非常多,按钮层级也深&#xf…

2026/8/31 13:18:34

CNN卷积神经网络零基础入门:PyTorch实现MNIST图像分类

CNN 卷积神经网络是深度学习入门绕不开的第一座山。很多零基础读者第一次接触 CNN 时,被卷积、池化、全连接、特征图、感受野这些名词劝退,但实际上它的设计逻辑非常朴素:让网络像人眼看图一样,先从局部细节开始识别,再…

2026/8/31 1:05:20

vSound小提琴数字处理器实操指南:从接线到演出的完整配置

电小提琴或者原声小提琴插电演出,第一个绕不开的坎就是声音难听。原声琴的共鸣和空气感一旦进了拾音器,出来的往往是一坨干瘪、发尖、带着奇怪塑料味的信号。我当初第一次把琴接上乐队调音台,直接被主唱吐槽"你这声音像在锯钢丝"。…

2026/8/31 2:14:20

传感器接口IC如何攻克生物化学传感的微弱信号难题?

1. 从电极到比特流:为什么生物化学传感必须依赖专用接口IC 做生物化学传感的人都有过类似的经历:明明传感器本身性能很好,信号输出却一塌糊涂——噪声大、漂移明显、重复性差,怎么调都达不到预期。很多时候问题并不在传感器&#…

2026/8/31 1:41:28

STM32F411CEU6多通道ADC采集:扫描模式+DMA实现详解

1. 多通道 ADC 的用武之地把“Multichannel ADC”和“STM32F411CEU6”这两个关键字放在一起,其实就是嵌入式开发里最常遇到的一类需求:用一块不算贵的 MCU,同时采集多路模拟信号。STM32F411CEU6 是 48 引脚的 Cortex-M4F 主控,主频…

2026/8/31 0:07:32

STM32C5设备支持包(IAR DFP)安装指南与常见坑

上一阵子在IAR里折腾一块基于STM32C5系列的新板子,工程从STM32CubeMX导出来之后怎么都编译不过。报错信息很干脆:找不到设备描述文件。跟着错误路径去查,发现指向的是一个让我愣了一下的名字:STMicroelectronics.stm32c5xx.2.1.0.…

2026/8/31 0:07:32

STM32N657 SWO引脚矛盾:CubeMX显示PB3,数据手册为PB5

拿到STM32N657这颗料的第一天,我就撞上了一个让人原地懵圈的引脚矛盾:CubeMX里清清楚楚显示SWO在PB3,翻开数据手册的引脚说明表,却赫然写着PB5。对于一个靠SWO输出调试日志吃饭的人而言,这种"工具和手册打架"…

2026/8/31 12:44:45

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/31 9:19:59

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/31 6:53:02

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…