lightzh
V2EX  ›  Local LLM

有用 mac 跑 minimax H3 的吗,好后悔买了 48G 内存的 macbook

  •  
  •   lightzh · 19h 58m ago · 3641 views

    最近 AI 漫剧挺火,打算用 minimax H3 跑一下,电脑是 MBP(M3 Max + 48G 内存),跑个清晰一点的 3-5S 的视频竟然要一个多钟,跑了几个,直接放弃。看了一下显卡价格,想想还是算了。

    当初选电脑的时候 M3 Max 满血版+48G 内存 和 M3 Max 残血版+96G 内存价格差不多,不知道怎么 sb 了选了 48G 的,CPU 应该都过剩了。

    不知道更高内存的 mac 跑起来会不会好一点?还是只能用高端显卡来跑?

    Supplement 1  ·  15h 16m ago
    感谢大家的解答,明白了。

    我是跑起来内存爆过几次,现在设置了预留 8G 内存,Swap 有时候能到几十 G ,还以为内存是很大限制。

    看来还是只能 N 卡来跑。
    39 replies    2026-09-22 00:44:15 +08:00
    ShadowPower
        1
    ShadowPower  
       19h 51m ago   ❤️ 1
    买了 96GB 内存也一样后悔,速度不变。要买 N 卡才不会后悔
    afkool
        2
    afkool  
       19h 47m ago   ❤️ 1
    跑图片和视频肯定 N 卡啊。。MAC 那个吞吐能力。。
    BlackSas
        3
    BlackSas  
       19h 47m ago   ❤️ 1
    新款的 apple 芯片才有本地部署的优化芯片。等 M6 或者 M7 的新款吧。
    lightzh
        4
    lightzh  
    OP
       19h 44m ago
    @ShadowPower #1 好吧,这么说那不后悔了 现在除了跑这个其他都够用
    crocoBaby
        5
    crocoBaby  
       19h 36m ago
    感谢实测,我还想着买个 macmini 创业做 h3 呢
    yarawen
        6
    yarawen  
       19h 28m ago
    @crocoBaby 用网页或者 API 不行吗? 我买的 plus 会员,可以消耗 5h 额度来生成视频了。
    wcwcxiaobin
        7
    wcwcxiaobin  
       19h 26m ago
    macbook 办公用不是挺好吗,挂机的话 mac studio 把,
    BUCKS
        8
    BUCKS  
       19h 25m ago   ❤️ 1
    目前 Apple 的芯片上的 NPU 都是为了本地系统的小功能制定的吧,应该还没开始往纯本地 LLM 的方面发展
    busln
        9
    busln  
       19h 20m ago   ❤️ 1
    M3 Max 满血版+64 内存
    测试了本地部署,只能说能跑玩玩还行,当生产力工具还差的很远
    AFOX
        10
    AFOX  
       19h 18m ago   ❤️ 1
    错了,视频生成吃的是算力,不仅仅是内存带宽,哪怕你上最新的 m5ultra 也不太可能接近 N 卡的速度
    whcattail
        11
    whcattail  
       19h 13m ago
    谁家好人自己花钱买这么高配置的电脑啊 。。。。。。
    diudiuu
        12
    diudiuu  
       19h 4m ago
    可以跑 3.8
    HENQIGUAI
        13
    HENQIGUAI  
       19h 4m ago   ❤️ 2
    后悔个啥啊,96G 照样拉跨,视频模型目前就不是本地单机能碰瓷的,不然 Seedance2.5 凭啥赚了几十亿
    baiic
        14
    baiic  
       18h 54m ago
    @yarawen token plan 不能用于 H3 的调用吧
    slowgen
        15
    slowgen  
    PRO
       18h 48m ago   ❤️ 1
    https://docs.sglang.io/cookbook/diffusion/MiniMax/MiniMax-H3 根据 SGLang 部署文档买显卡就行了
    jaswer
        16
    jaswer  
       18h 45m ago   ❤️ 1
    mac 跑跑 llm 还行,img/vid 还得上 nv
    iorilu
        17
    iorilu  
       18h 45m ago   ❤️ 1
    和 N 卡没法比阿

    你需要的事弄个 macair 配上 pc 服务器+N 卡

    反正现在弄个 agent 就写代码, 也不需要开 n 个 ide, 对机器要求不高
    maolon
        18
    maolon  
       18h 42m ago
    m 系列估计要到 m7 才算真正能上桌(但还是会很慢)
    DeffYang
        19
    DeffYang  
       18h 39m ago
    你的配置用云电脑跑一跑就行,就算和谐版云电脑也可以搞定。48G 到 96G 差价还是很大的,为了三分钟热度多花几千不是值得。
    chengxiao
        20
    chengxiao  
       18h 27m ago
    4090 跑 minimax h3 实测 15 秒 720p 大概 10 分钟左右,还可以接受
    但是跑 qwen 3.8-27B 上下文有点太小了,agent 工具动不动就压缩,复杂任务有点困难
    lengyuqu
        21
    lengyuqu  
       17h 53m ago   ❤️ 1
    实际上区别不大,max 系列的带宽到 m5max 才从 400 升到 600. 然而完全不具备生成视频的能力。只能当一个高性能多 agent 并行的高端笔记本了。本地我都放弃跑模型了,本地跑的智力还不如充 ds 来的实在
    xubeiyou
        22
    xubeiyou  
       16h 50m ago   ❤️ 1
    本地跑你就算是现在最新款最大内存的 你会发现吞吐量也就那样。。。。。否则 sd 能赚麻么- - 张一鸣都亚洲首富了
    et5494
        23
    et5494  
       15h 54m ago
    这个问题,我详细抉择过
    除了保密机构外,端侧大模型的都是个伪命题
    云端模型能给你的体验远远大于端侧
    而且,云端的进化速度也远大于本地。
    额外花的钱的情绪价值太低太低了
    bbao
        24
    bbao  
       15h 51m ago
    有没有便宜出的
    WWwwMMmmMMmmWWww
        25
    WWwwMMmmMMmmWWww  
       15h 28m ago
    要买老黄的卡才行
    sampeng
        26
    sampeng  
       15h 14m ago
    谁叫你们看各种安利文从来一个字都不说内存带宽呢。。几百 M 的小水管能干啥。。m5 ultra 可能可以。
    cvooc
        27
    cvooc  
       15h 10m ago   ❤️ 1
    给你个参考, 我是 4060 8g + 96g 内存, 我实测的 minimax h3 int8 步数 40

    10 秒视频
    320*320 分辨率要 3 分钟
    448*448 分辨率要 6 分钟
    576*576 分辨率要 12 分钟
    736*736 分辨率要 26 分钟
    1024*1024 直接要 208 分钟

    还是得看显卡, 不然只能玩票, 生产力就算了, 最简单的还是直接用平台...
    lxhreal
        28
    lxhreal  
       15h 10m ago
    我是 m5pro 64 跑这个速度真是慢 放弃了 怎么调优都不行 准备换 m5 max 试试
    RikkaFlame
        29
    RikkaFlame  
       14h 55m ago
    视频图片至少得 ultra 才行
    8355
        30
    8355  
       14h 41m ago   ❤️ 1
    你应该是不理解显存跑模型的逻辑
    本质上是不停的把模型加载进显存,然后运行,之后清理再持续加载.如果显存够大那么就不用清理或者说清理的次数少或者说重复加载的次数少.
    在非 mac 的算力机上会把模型加载进内存里,从内存加载进显存可以显著提高速度.
    这个过程就是会产生持续的大量内存 io 和显存 io

    你这 48g 杯水车薪
    JimmyG
        31
    JimmyG  
       14h 24m ago
    @lxhreal M5 Max 128G 也不行。
    yarawen
        32
    yarawen  
       13h 59m ago
    @baiic 网页可以,我试过。API 没试过。
    baiic
        33
    baiic  
       13h 30m ago
    @yarawen #32 我问了客服,不能调用
    lightzh
        34
    lightzh  
    OP
       13h 19m ago
    @lxhreal #28 都说 mac 不行,感觉要跑还是老老实实上 N 卡吧
    flyqie
        35
    flyqie  
       12h 52m ago
    mac 跑这种模型都不太值得其实,真要玩的话还是得考虑 n 卡,而且性价比和生态这块 mac 并不占优势吧?
    mengdu
        36
    mengdu  
       12h 41m ago
    护城河在那,没办法。
    ScforeverShawn
        37
    ScforeverShawn  
       12h 34m ago
    感觉对于个人或企业,端侧模型还是有小部分需求场景的。我的想法是,等发展速度放缓之后,根据需求选择甜品级模型和配套硬件。现在入坑风险有点高。
    lightzh
        38
    lightzh  
    OP
       12h 9m ago
    @flyqie #35 是的,跑视频的确实不太行,但是我跑一些 tts 的还可以
    chapiom
        39
    chapiom  
       5h 26m ago
    H3 这个模型确实是 cuda 有优势,显存塞不下,就放到内存里,内存塞不下,还可以放进硬盘。速度影响不是特别大,不像大语言模型,往内存一塞就慢得离谱。
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   990 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 74ms · UTC 22:10 · PVG 06:10 · LAX 15:10 · JFK 18:10
    ♥ Do have faith in what you're doing.