zktz
V2EX  ›  Local LLM

有没有人装过 Strata + Qwen3.8-Flash-Next 125b?我遇到的问题是在 workbuddy 里一直超时。

  •  
  •   zktz · 13h 18m ago · 710 views
    有没有人装过 Strata + Qwen3.8-Flash-Next 125b ?我遇到的问题是在 workbuddy 里一直超时。
    我用的 NVIDIA A6000 48G
    2× Xeon Silver 4210R @ 2.40GHz = 40 线程
    128G 内存
    硬盘是固态的
    我本来就是用 work buddy 远程控制安装的。开始用 workbuddy 安装,测试还不错。能到 90 多 tps 。套在程序代码里也没啥问题。但是套进 workbuddy 就有问题了,一直超时。我初步觉得是 workbuddy 上下文太长。然后套在 cherryStudio 里也不行。然后用 AI 分析 AI 解决。后来 cherryStudio 里好了。workbuddy 还是不行。最后 AI 分析是只要调用 tools 就有概率会崩。还有长上下文,在某个位置必崩。

    大家有什么好的建议么?
    6 replies  •  2026-10-04 19:57:52 +08:00
    anivie
        1
    anivie  
       13h 7m ago
    我也在尝试把 Starta 接入 codex 里用,发现 codex 里它不知道在哪执行的工具调用,思维链也不展示,一阵 thinking 之后直接告诉我在沙箱里什么也执行不了就退出了,给我整的一脸懵,现在在等官方支持 codex
    bigcata
        2
    bigcata  
       13h 1m ago
    非要用 workbuddy 干什么?
    oldlamp
        3
    oldlamp  
       12h 51m ago
    有可能是量化的问题?
    dford
        4
    dford  
       12h 14m ago
    试试用 pi 或 omp 呢,适配得挺好的
    cskeleton
        5
    cskeleton  
       11h 12m ago
    很可能是 wb 的问题,wb 还是有些私活,我把我的 codex 放 cpa 给朋友们用,朋友们发现不能生图,模型回复已经画好了,但是客户端看没有。分析了 wb 的文件之后发现它的生图只能走自己的渠道,其他渠道返回回来的图片直接静默丢弃。
    我通过 cpa 然后放在 dsh 里用,完全没问题。5070ti+64G 内存,跑 iq3_s 能有 40+ tps 。
    honjow
        6
    honjow  
       10h 34m ago
    我也接到 wb 用,正常的啊
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   754 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 30ms · UTC 22:32 · PVG 06:32 · LAX 15:32 · JFK 18:32
    ♥ Do have faith in what you're doing.