street000
V2EX  ›  OpenAI

GPT 6 Luna 这价格真的神了

  •  
  •   street000 · 2h 11m ago via Android · 3316 views

    5.6 Luna: 输入:0.25 美元/M 缓存输入:0.02 美元/M 输出:1.2 美元/M

    6 Luna: 输入:0.125 美元/M 缓存输入:0.01 美元/M 输出:0.5 美元/M

    输入降幅 50%,输出降幅 58%。

    AAI Index 单任务价格和 Token 效率看上去也是遥遥领先同类模型。

    要是奥特曼能让 TPS 再来个 50% 或者翻倍提升,感觉薅的 Gemini Flash 都没什么用的了。

    21 replies    2026-09-23 11:22:52 +08:00
    street000
        1
    street000  
    OP
       2h 1m ago via Android
    立刻用一个 Free 号跑了一个不大不小的任务:

    整个代码库 9 万多行 Kotlin ,先让它读代码规划变动。后续还进行了三轮对话,一轮确认开始改动,一轮修改变量名,一轮修复一个 lint 报错。

    速度:
    从开始到结束大概不算等待确认时间大概五六分钟,速度感觉还可以。

    代码质量:
    改动 10 个文件,新增代码 120 行,除了一个行宽超过限制的 lint 错误没有编译报错。增加的代码符合预期,没有乱加注释,除了一个变量名不符合我的想法。

    Token 用量:
    没用各类面板统计,总 Token 消耗不清楚,上下文窗口占 182K / 258K ,感觉在意料之中,没有雷霆大思考。但 Free 号月额度下降 12%,额度消耗还是过大,API 50%的降价感觉没有完全反映到 Free 号额度上。看来用几个 Free 号来实现 Token 自由还是不可行,薅的 Gemini 感觉还是有用处的。
    street000
        2
    street000  
    OP
       1h 56m ago via Android
    思考强度:xhigh
    snakejia
        3
    snakejia  
       1h 53m ago
    这个是 api 的价格吧
    street000
        4
    street000  
    OP
       1h 47m ago via Android
    @snakejia 是的
    sweord
        5
    sweord  
       1h 45m ago
    比较了 6 luna 和 5.6 luna 。6 luna 消耗快得多,跟 5.6 terra 差不多吧
    street000
        6
    street000  
    OP
       1h 40m ago via Android
    缺点:规划能力和意图理解似乎没有提升,复杂需求还是会错意理解。看来还是只能作为执行模型,要么人工审核它的计划要么让大点的模型来规划。
    street000
        7
    street000  
    OP
       1h 37m ago via Android
    @sweord 感觉 API 降价并没有反映到 Codex 用量消耗上
    street000
        8
    street000  
    OP
       1h 13m ago via Android
    体感性能没提升已经觉得没那么香了,看到 Flex Tier 一半的价格又感觉香了:

    输入:0.0625 美元/M

    缓存输入:0.005 美元/M

    输出:0.25 美元/M

    已经来到 Mimo Flash 和旧 DeepSeek Flash 的领域。

    试了在 OpenRouter 调 Flex Tier API ,目前首字延迟还能维持在 1.5s - 2.5s ,TPS 在 50 - 90 ,似乎和标准模式没区别。便宜 Token 时代好像又回来了。
    test1199
        9
    test1199  
       1h 2m ago
    这样大家就相当于流水线质检员了, 再过一段时间全自动了, 大家就都要失业了
    jonty
        10
    jonty  
       51 mins ago
    神在哪,tps 低的要死。这个能力的模型就得图快,真不如 cline pass 的 ds4f
    bghtyu
        11
    bghtyu  
       42 mins ago
    ChatGPT 订阅的额度是 API 价格的好多倍,换算下来 Luna 真的超级便宜。
    oldManNewThought
        12
    oldManNewThought  
       24 mins ago
    我使用下来,感觉还是很省,不比 5.6-lunu 更多消耗,超省 token
    street000
        13
    street000  
    OP
       18 mins ago via Android
    @jonty Codex Free 大概 40 tps ,慢一点不过能免费用,挂个 CPA 用来翻译总结之类很可以了。用 API 有 60-90 tps 感觉也够用了。
    street000
        14
    street000  
    OP
       16 mins ago via Android
    @bghtyu 确实,现在最大的问题就是慢了
    ntdll
        15
    ntdll  
       15 mins ago
    很不幸的是,今天 web 上的 thinking 模型,已经弱智到流口水了。现在 5.4 mini 下线了,不知道是给路由到哪个小模型上了
    dyikai
        16
    dyikai  
       15 mins ago
    就 6 luna 这个价格,我为什么不用 DS 4.1🤣
    Tolcol
        17
    Tolcol  
       11 mins ago
    降价了,也降智了
    solost475
        18
    solost475  
       10 mins ago
    订阅计划的 gpt6luna 还没上吗?
    dongzhimin
        19
    dongzhimin  
       9 mins ago
    6 sol/luna 这跑分不就是 5.6 改名么
    street000
        20
    street000  
    OP
       7 mins ago via Android
    @oldManNewThought 刚刚清空上面任务的对话看到输出 token 才 56k ,确实很省。让 Gemini Flash 来,只是规划可能都不止 56k 了。
    street000
        21
    street000  
    OP
       Just Now via Android
    @solost475 应该有了吧,可能需要更新重启 Codex
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   5480 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 76ms · UTC 03:23 · PVG 11:23 · LAX 20:23 · JFK 23:23
    ♥ Do have faith in what you're doing.