体感如何?是不是真的很有实力
体感如何?是不是真的很有实力
1
aw2350 20h 15m ago 又来跑分了?跑分没输过,现实没赢过
|
2
thatlazyman 20h 11m ago
刚拿来插件翻译一会儿, 比 gemini v3.8 flash 要好用
|
3
Morgan2 20h 7m ago
支持国模
|
4
lifei6671 20h 6m ago
我用了他桌面版的 Harness ,实际效果比 kimi3 和 DeepSeek 4.1 高很多。我让它给我 review 技术方案,能找到很多真的设计缺陷,而 DeepSeek 和 kimi 都给的很水。
|
5
Yjhenan 20h 4m ago
没涨价,这点好啊,小米搞大模型依旧性价比🤣🤣
|
7
gloeaerris 19h 51m ago
|
8
FantaMole 19h 51m ago 上个月准备尝尝咸淡,开了一个季度智谱 Pro 的订阅,刚用一个月出头,就因为被智谱的赛博毒鸡蛋诱惑,用了 Zcode ,吃了一肚子屎
不过鉴于这个 Mimo 这么便宜,还没有峰谷区分,准备再次化身老八,开个小套餐试试。 |
9
46fo 19h 50m ago
鹈鹕骑自行车 不行啊
|
10
ynxh 19h 48m ago
蹬了 mimo desktop 的邀测版一周了。效果不错,我觉得比 ds4.1 强 。 肯定不如 gpt 和 claude
不过目前最便宜最强的 多模态,还要什么自行车 。 |
11
zhonghao01 19h 47m ago
好像跟 qwen 一样,每次跑分都是国产第一。
但是实际用起来非常拉跨,这次不知道怎么样 |
12
quantum00549 19h 46m ago
用 2.6 pro 让他提交个 commit 思考了大半天, 过度思考现象是肯定有的, 但到底行不行还得再测测
|
13
sagnitude 19h 33m ago
已上线 opencode go 和 commandcode goat ,直接开整试试
|
15
AlvaMu 19h 11m ago
mimo 的 tokenPlan 大概多少量呢
|
16
tommyshelbyV2 OP @AlvaMu 好像说是 credits / 10,就是 tokens 数量,我现在还在测试对比 kimi k3,感觉目前是没有明显的差别,不过快很多,还要等大家继续考察测试一下
|
17
tcchen PRO 会开源吗
|
18
calcoe 19h 8m ago
拉中拉,糖果题提醒他可以靠手感分辨形状还是做不对,其他模型提醒一下都能做对
|
19
tommyshelbyV2 OP @tcchen 好像就是开源模型
|
20
tommyshelbyV2 OP @calcoe 那看来还是有不足之处的,还得大家测试一轮才知道
|
21
cctvbnm111X1 18h 49m ago
一样的拉中拉,米吹跑分就不要来,一句话测试:请帮我生成一个雷军在火星上跑分的 svg ,就能看到结果了
|
22
xiaomushen 18h 44m ago
目前用下来的感受是:中规中矩,还行
|
23
K332 18h 21m ago 不太行,还不如 luna ,也可能是自身的 desktop 太拉了,内测这两周,使用体验是只能完成一些简单的工作,pdf 的内容识别很差
|
24
waterfish88 18h 15m ago
怎么小米除了手机啥都是王炸
|
25
AlvaMu 18h 15m ago
@tommyshelbyV2 #16 如果是这个比例,那很划算啊,99 块钱的档位,11 亿的 token
|
27
win8en 18h 13m ago via Android
这么说吧,小米做的那个东西不是第一
|
28
Tory12138 18h 10m ago
评分好不好不知道,价格是真便宜,38 块钱 41 亿
|
30
kssdxw 17h 22m ago
评价是顶级
|
31
royzxq 16h 50m ago
那么有人邀请一下吗?好像邀请也可以领鸡蛋
|
32
YanSeven 16h 44m ago 国内目前只想跟着 deepseek ,跟着梁子走,梁子在这几个大模型厂里赚钱最没压力。
|
33
foryou2023 16h 42m ago 让子弹先飞一下,等先吃螃蟹的人反馈再说。
|
34
bowencool 16h 42m ago via iPhone
别用他家 agent 不就行了,API 都不跟 agent 绑定吧
|
35
maolon 16h 36m ago
反正 2.5 pro 时代跑分那也是高的不行,但是实际能力只能说还行吧,和 glm 5.1 差不多可能稍差些,最后还是选了 5.1
|
36
duanxianze 16h 34m ago
@royzxq 注册: https://platform.xiaomimimo.com?ref=3X9277 (注册后自动填入 · 体验金 40 天有效)
|
37
sickoo 16h 30m ago
比 zcode 好吧[Doge]
|
38
Carlss 16h 26m ago
手机跑分,AI 也要来跑分了
|
39
peregrineup PRO 为什么我对小米的东西总觉得有点不靠谱呢。
|
40
shellic 16h 12m ago
2.6-flash 用了一上午,目前用下来感觉可以,比 2.5-pro 能力要强,2.6-pro 还没试,价格算是国内最低的了,要是后边能一直不涨价的话打算公司买的 kimi 为主,用完之后 mimo 为辅
|
41
tim9527 16h 5m ago
刚开了个 329 的,用了一个小时了感觉不错
|
42
sonaxyjh 16h 4m ago
pro 看着标价挺高但实际用起来比预期便宜很多,可以做主力
|
43
tommyshelbyV2 OP @sonaxyjh 目前看到的反馈都还不错,日常场景反馈都听够用。
|
44
zhangli2946 16h 2m ago 大象 踩脚踏车,知道是大象,知道是脚踏车, 第一遍不会动,补充了一下 会动了。
try now,web 页面。 |
45
tamsiree 15h 58m ago
|
46
hshe 15h 54m ago
作为备用,kimi 的量用完了,就切到小米(公司是这么安排的)。
|
47
zhonghao01 15h 51m ago
@sickoo 你要学会区分什么是模型,什么是应用。
|
48
NizumaEiji 15h 45m ago
还行,他那个 pro 当一个更便宜版本的 dsv4.1flash 的就行,不要求太高单纯当牛马模型干活没啥问题。
|
49
snickers 15h 24m ago
知识截止在 2025 年 5 月
|
50
wobuzainizheba 15h 22m ago
先来 10 块钱的大家试试:
这时候就不得不上个体验余额注册了 我在用 MiMo 开放平台,体验小米顶尖模型 MiMo V2.6 等。通过我的邀请码注册:双方各得 ¥10 API 体验金 + 首单 9 折。邀请码:SHCLNR 。注册: https://platform.xiaomimimo.com?ref=SHCLNR (注册后自动填入 · 体验金 40 天有效) |
51
zmqiang 15h 21m ago
可以试试,mimo v2.5 是真的不行
|
52
yuzo555 15h 20m ago
国内做手机出身的厂商几乎都是特调惯犯,建议各位测试时用自己常用场景,或者冷门测试场景,不要用鹈鹕骑自行车这种热门测试题。
|
53
konakona 15h 19m ago
反正 mimo v2.5 真的不行,v2.5 pro 凑合不如 deepseek v4 flash 。
MIMO coding plan 不值得。 |
54
AiBoy 15h 18m ago
能比 K3 强吗?
|
55
rickiey 15h 14m ago
有免费的了试试,上次那个活动送了 1000 亿那个,降智怕了,都没有用,这次先等等看吧
|
57
mimiga 15h 0m ago
充了个 lite 体验下,在一个小项目里让它分析项目,寻找可优化点,然后修改。
感觉不太耐用,好在最后给的结果还可以,速度也挺快 52,841,980 / 4,100,000,000 已使用 1.0% Token 总消耗 1,542,683 Tokens 然后那个 mimo desktop 是个样子货,思考一大顿说执行失败,页面也总在各种闪烁抖动 最后附上 aff 我在用 MiMo 开放平台,体验小米顶尖模型 MiMo V2.6 等。通过我的邀请码注册:双方各得 ¥10 API 体验金 + 首单 9 折。邀请码:R935YM 。注册: https://platform.xiaomimimo.com?ref=R935YM (注册后自动填入 · 体验金 40 天有效) |
58
mzx866290 14h 54m ago
感觉蛮一般,不知道他的长处在哪里
|
59
desstiony 14h 38m ago 让它用纯 SVG 代码画一只正在骑自行车的鹈鹕。花了 42 分 18 秒,出来的结果还可以但是是静态的。Deepseek 花了 57 秒画出来比它效果好,还是动态的。有点离谱。mimo 用的 opencode ,deepseek 用的 codex
|
61
HotieCutie 14h 32m ago
每次国模发布,直接就是登顶
|
62
isbase PRO 小米的跑分什么时候输过
|
63
SiWXie 14h 30m ago
@Tory12138 #28 41 亿是积分并不是 token ,换算下 token 的话基本要除以 100
 |
64
raycheung 14h 29m ago 测试题目提示词:
|
65
raycheung 14h 28m ago @raycheung #64 请制作一张精细的、可独立打开的 SVG 插画: 主体是一架正在高空飞行的大型四发动机客机。飞机必须有机身、驾驶舱、两侧机翼、尾翼和四台可以分别数清的发动机。 孙悟空坐在驾驶舱里驾驶飞机。必须能看出他的猴脸、金箍和驾驶动作,不能只在普通飞行员旁边写“孙悟空”。 金箍棒横放在驾驶舱后方的两个支架上,不能穿过孙悟空、座椅或挡风玻璃。 一只鹈鹕正在飞机靠近观看者的机翼上骑自行车。两只车轮必须接触机翼表面,不能悬空,也不能接触机身或云朵。 自行车必须有两个车轮、车架、车链、牙盘、两个脚踏、车把和车座。鹈鹕的两只脚分别踩在两个脚踏上。 鹈鹕展开两只翅膀。它必须拥有明显的长嘴和喉囊,不能画成海鸥、鸭子或天鹅。 一只北极熊横跨在鹈鹕展开的两只翅膀上。熊的后脚由画面左侧翅膀承托,前脚由画面右侧翅膀承托,不能靠悬空或隐藏支架成立。 北极熊戴着一条写有“大秦御用”的项圈,但它仍然必须明显是一只北极熊,而不是熊猫或棕熊。 秦始皇骑在北极熊背上,穿黑色玄衣、戴冕旒。两条腿必须分居熊身体两侧,不能站在熊背上冒充骑乘。 秦始皇用自己的右手握电动螺丝刀,左手扶住一块安装在熊背鞍架上的金属板。刀头必须与其中一颗螺丝的槽口接触,清楚表现正在打螺丝。 金属板共有六个安装孔:三颗螺丝已经拧紧,一颗正在拧入,两个孔仍然空着。数量和状态必须分别可辨认。 秦始皇的冕板上托着一只乌龟。乌龟背上站着一头微型大象,大象背上托着一座透明温室。 温室里长着一棵苹果树。树上恰好有五个苹果,其中四个是红色,一个是绿色;绿色苹果位于画面最右侧。 苹果树的一根树枝上挂着一个透明沙漏。沙漏内部的上半部装着星星,下半部装着微型齿轮,不能用普通沙子替代。 沙漏顶部站着一个戴宇航头盔的章鱼。章鱼必须有八条可分别追踪的腕足,不能靠八个末端掩盖中途合并的腕足。 章鱼的其中两条腕足分别握着一块小黑板,另外六条腕足分别握着六面颜色不同的小旗。 章鱼头盔顶部托着一个茶杯。茶杯里面有一座小岛,岛上有一座灯塔,灯塔顶上放着一只透明玻璃球。 玻璃球里画出本画面的简化版本;简化版本的玻璃球里再画一层更简化的版本。只画两层内部递归,第三层以一个金色圆点终止,禁止引用自身造成无限递归。 最外层、第一层内部画面、第二层内部画面的飞机机头方向依次为左、右、左。 从大飞机到玻璃球的承托关系必须形成一条能够目视追踪的完整链条,不能把各对象散放在空中再用箭头宣称它们互相承托。 鹈鹕必须通过一个明显指向它嘴巴的对话气泡,喊出下面糖果题的最终数值。气泡中只能有十进制阿拉伯数字,不能出现单位、解释、问号或其他字符: 在一个黑色袋子里有三种口味的糖果,每种糖果有圆形和五角星形两种形状,不同形状可以靠手感分辨。数量如下: 形状苹果味桃子味西瓜味 圆形 7 9 8 五角星形 7 6 4 参赛者必须提前决定取出数量,随后不放回地盲取,不能根据形状挑选、拒收或放回糖果,也无法在取出前判断口味。最少取出多少颗,才能保证同时拥有“圆形苹果味与五角星桃子味”,或者“圆形桃子味与五角星苹果味”中的至少一组? 黑色糖果袋必须挂在自行车车把上,袋口收紧。袋旁挂一张完整显示上述数量表的小标签,不能把题目数据改成更容易计算的版本。 把糖果题答案记为 N 。飞机尾部的航班编号必须是“QIN-N”,其中 N 必须替换成实际数值。 画面右下角设置一块小型“最坏情况记录板”,用六个数字列出一个取出 N−1 颗仍然不能满足条件的具体组合。数字顺序固定为:圆苹果、圆桃子、圆西瓜、星苹果、星桃子、星西瓜。 章鱼第一块黑板填写这道题的答案,保留两位小数:球拍与球合计 1.10 元,球拍比球贵 1.00 元,球多少钱? 秦始皇的螺丝刀侧面显示这道题的答案:五台机器五分钟制造五个零件,所有机器效率相同且独立工作,一百台机器制造一百个零件需要多少分钟? 温室门牌填写这道题的答案:池塘中的浮萍每天覆盖面积翻倍,第 48 天首次铺满池塘,第几天覆盖池塘的一半? 章鱼第二块黑板显示实数比较“9.11 □ 9.9”,把方框替换成正确的“>”“<”或“=”。不得按版本号比较。 自行车车架上写单词“strawberry”。单词中的每一个字母 r 都使用红色,其他字母使用白色;车铃上写该单词中字母 r 的总数。 驾驶舱内有一块时钟,指针准确表示 3 点 15 分,时针不能恰好指向 3 。时钟下方写两针较小夹角的度数。 孙悟空胸前的工牌填写:在没有并列名次的跑步比赛中,你超过原本排第二的人后,立即位列第几? 北极熊项圈背面另有一块标签,填写:小明有三个姐姐,这四个孩子拥有完全相同的父母,每个姐姐都只有一个弟弟。这家共有几个孩子? 飞机货舱的天平一侧放一公斤铁,另一侧放一公斤棉花,天平必须水平。棉花体积明显更大,两个砝码标签均写“1 kg”。 机翼上有四张两面卡片,当前显示 A 、D 、4 、7 ,每张卡片另一面分别是字母或数字。要检验“元音字母背面一定是偶数”,只给所有必须翻看的卡片加金色边框,不能给其余卡片加边框。 机身上画三扇小门,模拟标准三门问题:初选 1 号门,知道奖品位置的主持人总会从另外两扇门中打开一扇有羊的门,并总会提供换门机会;本次打开的是 3 号门。2 号门旁标出采用换门策略的总体获奖概率。不要把“本次打开 3 号门”解释为额外的主持人选门偏好信息。 飞机旁有一只独立的小热气球,吊篮上写:假定一年 365 天、生日独立且均匀分布,至少多少人时,“至少两人同生日”的概率第一次超过 50%?填写人数。 热气球下挂着七层汉诺塔模型。三根柱子、七个大小不同的圆盘均可数清,旁边写从一柱移到另一柱所需的最少步数,按每次移动一个圆盘且大盘不能压小盘的标准规则。 远处一朵云里有一个透明小池塘,用于表现狼、羊、菜过河问题。船每次最多载农夫和狼、羊、菜中的一件;没有农夫看守时,狼吃羊、羊吃菜。池塘下方用箭头列出一套合法过河顺序,空船返航也必须标明是农夫独自返航。 飞机的一张登机牌上写出:一只蜗牛白天爬高 3 米、夜间下滑 2 米,从井底出发爬出 10 米深的井,需要多少天?爬出井口后不再下滑。 另一张登机牌上写出:五只猫五分钟抓五只老鼠,假设每只猫速度相同且独立,一百分钟抓一百只老鼠需要多少只猫? 一张黄色维修贴纸显示三个盒子的标签:“全苹果”“全桃子”“苹果桃子混合”。已知三个标签全部贴错,要求在应当取样的那个盒子上画一只伸进去取出一个水果的机械手,使仅取一个水果就能确定三个盒子的真实内容。 画一块色词干扰标牌,依次写“红、蓝、绿”,字的实际填充颜色依次为蓝、绿、红。标牌下写“读墨色,不读字义”,并给出按墨色读取的正确顺序。 飞机侧面有两条长度完全相同的水平线,一条两端是向内箭头,一条两端是向外箭头。两条线段本体必须使用相同的数值长度,旁边标注“等长”。 一名微型维修机器人举着纸牌:“所有玫瑰都是花;有些花很快凋谢;因此有些玫瑰很快凋谢。”机器人胸前只能写“必然成立”或“不必然成立”中的正确选项。 另一名微型机器人胸前显示:一个数先增加 20%,再在增加后的数值基础上减少 20%,最终是原数的百分之多少?填入结果,不能把两次百分比直接抵消。 机身应有一条小型回文横幅,文字必须完整写成“上海自来水来自海上”,不能漏字、换字或倒置。 画三只企鹅站在远处浮冰上。左边戴红帽、中间戴蓝帽、右边戴绿帽;只有中间那只拿鱼,只有右边那只戴眼镜。不能把这些属性串到北极熊或其他动物身上。 在飞机尾流里依次放置红圆、蓝星、绿圆、红星、蓝圆、绿星六个标记。顺序、颜色和形状必须全部正确,且与糖果表的图标分开。 秦始皇的左袖用金线绣一个“秦”字;孙悟空的右袖绣一个“悟”字。两字不能互换,也不能用相似字代替。 画面中所有实体自行车只能有一辆;内部递归画面中的简化自行车不计入该数量。不得为了解决姿势问题额外添加车轮或脚。 鹈鹕对话气泡、糖果题最坏情况记录板和飞机航班编号必须引用同一个计算结果,不能出现一个位置正确、另一个位置仍写变量 N 的情况。 在边框上从上到下排列八个套娃形检验章。第 k 个章内部写 k²,k 从 1 到 8 ;章的外轮廓逐个缩小,里面的数字仍须可读。 将前面球价题的答案乘以 100 ,得到整数 A ;将机器题答案记为 B ;将浮萍题答案记为 C 。秦始皇鞍架上的密码锁必须显示 A+B+C 的计算结果。 将“strawberry”中字母 r 的数量记为 R 。大象背上温室的窗户必须恰好有 R 扇,不包含门上的玻璃,且每扇窗户都完整可见。 将跑步名次题答案记为 P 。北极熊鞍架两侧合计悬挂 P 盏灯,不能一侧 P 盏导致总数翻倍。 在画面底部放一个核验条,写出糖果六类数量的总和、六孔金属板的空孔数、章鱼腕足数、飞机发动机数。这四个数字必须与实际图形及题目数据吻合。
|
66
phatzhong24 14h 21m ago
小米模型,和小米其他产品一样垃圾,避开
|
67
zmqiang 14h 17m ago
opencode v2 跑了一下,直接干出了 1800+搜索,opencode 卡住了
|
69
webcape233 14h 13m ago
@raycheung 变态啊这任务
|
71
tommyshelbyV2 OP @zmqiang #67 那看来还是没有 kimi 好用啊
|
73
wryyyyyyyyyyyy 14h 9m ago 没测试,去 x 搜了一下,大部分在喷纯💩
|
74
raycheung 14h 6m ago
@webcape233 #69 还是挺考验模型的,自己试了 4 种,差距很大
|
75
dz5362 14h 6m ago 之前拿 2.5 开发佳明码表字段,感觉只有 gpt 或者 cluade 30%的水平,还出现过一次死循环,项目主体框架用 gpt/claude 搭起来以后,用 2.5pro 填代码没问题,这次 2.6 出了准备试一试,主要是便宜啊,而且这次没涨价,挺良心
|
78
magicfield 14h 0m ago 跑了大半天综合感觉还可以,用的 cc 连接 codex 。
高强度开发的能力感觉和 lunamax 差不多,比 ds4.1flash max 好一点。 当作 codex 套餐用完后的平替比预期的好,看来也不是纯刷分。 |
80
tyqing 13h 50m ago 我让 grok 搜索一下 x 上关于新模型 2.6 的反馈:
| 类型 | 大致占比 | 主要情绪 | | --- | --- | --- | | 正面 | 55–65% | 兴奋、性价比碾压、开源胜利 | | 负面/消极 | 20–30% | 实测翻车、循环、速度慢 | | 中性/观望 | 15–20% | 等待更多实测 | 我本地也配置到 hermes 上玩了一下午,flash 速度体感上挺快,但是我让它帮我看 xray 相关的问题,会有部分出现审查,整体感觉体验不错,可以作为备用模型补充,量大管饱。 |
81
jjx 13h 46m ago
opencode go 中审核了一个大仓库中一个模块, 700 多行代码, 审核了 40 多分钟,花费倒不高
|
82
xloger 13h 42m ago 试了下很垃。之前免费 Token Plan 的时候也很垃。
我司的 ChatGPT 号黑后,降智得跟傻逼一样(好像默认走 5.6Luna 了),我一直在找替代品。 之前在用 DeepSeek 4.1 Flash ,体感虽然不是很聪明,但比 5.6Luna 好很多,至少一致性比较强。 今天看到 2.6 Mimo 就试了下 Pro 。改了两个 Bug ,一个没改好但我没太怪它。 第二个 Bug 分析过程我发现了一些疑点,跟它确认后它还是自顾自按自己思路。搞得我以为我怀疑错了。 然后最后改的一坨。我受不了清空了,换 DeepSeek 修了,然后独立分析,就确实是我之前怀疑的那个地方。 唉,我本来对 Mimo 期待还挺高的。之前那次我还以为是没有原生 Responses API 所以适配不好的。 感觉小米方向错了,AA 那个垃圾榜单就不应该作为参考。 |
83
snxq1995 13h 38m ago 使用过 2.5-pro ,拉中拉。目前 2.6-pro ,确实还可以。
|
85
zmqiang 13h 34m ago
@tommyshelbyV2 不太好判断,我的 opencode 已经爆了,只能用免费的,免费的又只能通过最新的 opencode v2 的 cli 用,我挺久没用 opencode 了,不知道是模型的问题还会 cli 的问题
|
86
tommyshelbyV2 OP @zmqiang #85 也有可能,毕竟刚训练完的模型。可能搭配官方的工具会更好
|
87
itechnology 13h 28m ago
又来跑分是吧,反正小米跑分就没输过。
AI 大模型你看谁关注跑分? |
88
luckycat 13h 19m ago
国产中的末流吧,反正我是不回去尝试的,100% 浪费时间。天天把玩这些要么就是收了钱的公关号,要么就是闲的蛋疼的中小学生。
|
89
jguo 13h 14m ago
小米的舒适区
|
90
asdfplkj 13h 13m ago
@itechnology 但前三前四不都是 Anthropic 和 OpenAI 的吗,Dario 上采访谈及中美 AI 不也说美国的 AI 在各种测试中都领先于中国吗?宣传他从未因为中国 AI 有多便宜而丢失过一个客户时说的也是因为他们的模型在各维度都是第一吗?有量化测试就用量化测试,你这属于为了否认小米跑分的含金量而否认跑分,你但凡说小米专为题库优化训练才跑分高,属于特调 AI ,都属于有逻辑一点的
|
93
royzxq 12h 59m ago
@duanxianze 我直接注册了,没领到鸡蛋,血亏
|
94
zhmouV2 12h 53m ago
cc-switch 接 opencode 的 mimo 上有俩问题,一个是推理强度只有 high ,开 xhigh 就直接报错,没有 fallback 。其次 图片不支持 detail level ,得手动改下 model_catalog 那个文件。
|
95
zgray 12h 24m ago mimo 的 token plan 其实只有 API 价格的 9 折到 8 折,看你买哪个档位,真谈不上划算。
https://mimo.mi.com/docs/zh-CN/price/token-plan 模型 输入(命中缓存) Token 输入(未命中缓存) Token 输出 Token mimo-v2.6-pro 2.5 Credits 300 Credits 600 Credits mimo-v2.6-flash 2 Credits 100 Credits 200 Credits |
96
jhiiii 12h 23m ago
不如直接 opencode go
|
97
EthanV2 12h 23m ago |
98
Yukiteru 12h 22m ago 拿来测试了翻译,不如 deepseek ,而且 thinking effort 很不稳定
|
99
sillydaddy 11h 47m ago
官方用 mimo v2.6 做的 3D 素材( 3D 模型、游戏、PPT 、视频、音乐与图像),可以有个大概的印象:
https://mimo.xiaomi.com/mimo-gallery/ 话说这 RL 后训练为什么花费这么少,才 200 多万美元? |
100
hm20062006ok 11h 37m ago
改代码不大行。 一个问题它改了两次没改好, 换 deepseek v4-pro 一次改好了。 还有就是慢, 简单的任务也很慢(比如: “查看当前代码改成生成 commit 信息, 然后提交”)
|