最近 AI 漫剧挺火,打算用 minimax H3 跑一下,电脑是 MBP(M3 Max + 48G 内存),跑个清晰一点的 3-5S 的视频竟然要一个多钟,跑了几个,直接放弃。看了一下显卡价格,想想还是算了。
当初选电脑的时候 M3 Max 满血版+48G 内存 和 M3 Max 残血版+96G 内存价格差不多,不知道怎么 sb 了选了 48G 的,CPU 应该都过剩了。
不知道更高内存的 mac 跑起来会不会好一点?还是只能用高端显卡来跑?
最近 AI 漫剧挺火,打算用 minimax H3 跑一下,电脑是 MBP(M3 Max + 48G 内存),跑个清晰一点的 3-5S 的视频竟然要一个多钟,跑了几个,直接放弃。看了一下显卡价格,想想还是算了。
当初选电脑的时候 M3 Max 满血版+48G 内存 和 M3 Max 残血版+96G 内存价格差不多,不知道怎么 sb 了选了 48G 的,CPU 应该都过剩了。
不知道更高内存的 mac 跑起来会不会好一点?还是只能用高端显卡来跑?
1
ShadowPower 19h 51m ago 买了 96GB 内存也一样后悔,速度不变。要买 N 卡才不会后悔
|
2
afkool 19h 47m ago 跑图片和视频肯定 N 卡啊。。MAC 那个吞吐能力。。
|
3
BlackSas 19h 47m ago 新款的 apple 芯片才有本地部署的优化芯片。等 M6 或者 M7 的新款吧。
|
4
lightzh OP @ShadowPower #1 好吧,这么说那不后悔了
现在除了跑这个其他都够用 |
5
crocoBaby 19h 36m ago
感谢实测,我还想着买个 macmini 创业做 h3 呢
|
7
wcwcxiaobin 19h 26m ago
macbook 办公用不是挺好吗,挂机的话 mac studio 把,
|
8
BUCKS 19h 25m ago 目前 Apple 的芯片上的 NPU 都是为了本地系统的小功能制定的吧,应该还没开始往纯本地 LLM 的方面发展
|
9
busln 19h 20m ago M3 Max 满血版+64 内存
测试了本地部署,只能说能跑玩玩还行,当生产力工具还差的很远 |
10
AFOX 19h 18m ago 错了,视频生成吃的是算力,不仅仅是内存带宽,哪怕你上最新的 m5ultra 也不太可能接近 N 卡的速度
|
11
whcattail 19h 13m ago
|
12
diudiuu 19h 4m ago
可以跑 3.8
|
13
HENQIGUAI 19h 4m ago 后悔个啥啊,96G 照样拉跨,视频模型目前就不是本地单机能碰瓷的,不然 Seedance2.5 凭啥赚了几十亿
|
15
slowgen PRO https://docs.sglang.io/cookbook/diffusion/MiniMax/MiniMax-H3 根据 SGLang 部署文档买显卡就行了
|
16
jaswer 18h 45m ago mac 跑跑 llm 还行,img/vid 还得上 nv
|
17
iorilu 18h 45m ago 和 N 卡没法比阿
你需要的事弄个 macair 配上 pc 服务器+N 卡 反正现在弄个 agent 就写代码, 也不需要开 n 个 ide, 对机器要求不高 |
18
maolon 18h 42m ago
m 系列估计要到 m7 才算真正能上桌(但还是会很慢)
|
19
DeffYang 18h 39m ago
你的配置用云电脑跑一跑就行,就算和谐版云电脑也可以搞定。48G 到 96G 差价还是很大的,为了三分钟热度多花几千不是值得。
|
20
chengxiao 18h 27m ago
4090 跑 minimax h3 实测 15 秒 720p 大概 10 分钟左右,还可以接受
但是跑 qwen 3.8-27B 上下文有点太小了,agent 工具动不动就压缩,复杂任务有点困难 |
21
lengyuqu 17h 53m ago 实际上区别不大,max 系列的带宽到 m5max 才从 400 升到 600. 然而完全不具备生成视频的能力。只能当一个高性能多 agent 并行的高端笔记本了。本地我都放弃跑模型了,本地跑的智力还不如充 ds 来的实在
|
22
xubeiyou 16h 50m ago 本地跑你就算是现在最新款最大内存的 你会发现吞吐量也就那样。。。。。否则 sd 能赚麻么- - 张一鸣都亚洲首富了
|
23
et5494 15h 54m ago
这个问题,我详细抉择过
除了保密机构外,端侧大模型的都是个伪命题 云端模型能给你的体验远远大于端侧 而且,云端的进化速度也远大于本地。 额外花的钱的情绪价值太低太低了 |
24
bbao 15h 51m ago
有没有便宜出的
|
25
WWwwMMmmMMmmWWww 15h 28m ago
要买老黄的卡才行
|
26
sampeng 15h 14m ago
谁叫你们看各种安利文从来一个字都不说内存带宽呢。。几百 M 的小水管能干啥。。m5 ultra 可能可以。
|
27
cvooc 15h 10m ago 给你个参考, 我是 4060 8g + 96g 内存, 我实测的 minimax h3 int8 步数 40
10 秒视频 320*320 分辨率要 3 分钟 448*448 分辨率要 6 分钟 576*576 分辨率要 12 分钟 736*736 分辨率要 26 分钟 1024*1024 直接要 208 分钟 还是得看显卡, 不然只能玩票, 生产力就算了, 最简单的还是直接用平台... |
28
lxhreal 15h 10m ago
我是 m5pro 64 跑这个速度真是慢 放弃了 怎么调优都不行 准备换 m5 max 试试
|
29
RikkaFlame 14h 55m ago
视频图片至少得 ultra 才行
|
30
8355 14h 41m ago 你应该是不理解显存跑模型的逻辑
本质上是不停的把模型加载进显存,然后运行,之后清理再持续加载.如果显存够大那么就不用清理或者说清理的次数少或者说重复加载的次数少. 在非 mac 的算力机上会把模型加载进内存里,从内存加载进显存可以显著提高速度. 这个过程就是会产生持续的大量内存 io 和显存 io 你这 48g 杯水车薪 |
35
flyqie 12h 52m ago
mac 跑这种模型都不太值得其实,真要玩的话还是得考虑 n 卡,而且性价比和生态这块 mac 并不占优势吧?
|
36
mengdu 12h 41m ago
护城河在那,没办法。
|
37
ScforeverShawn 12h 34m ago
感觉对于个人或企业,端侧模型还是有小部分需求场景的。我的想法是,等发展速度放缓之后,根据需求选择甜品级模型和配套硬件。现在入坑风险有点高。
|
39
chapiom 5h 26m ago
H3 这个模型确实是 cuda 有优势,显存塞不下,就放到内存里,内存塞不下,还可以放进硬盘。速度影响不是特别大,不像大语言模型,往内存一塞就慢得离谱。
|