首页/新闻/GLM-5.3-Flash will likely handle 45% of your AI workloads
价格调整

GLM-5.3-Flash可能会处理45%的人工智能工作负载

venturebeat
2026年8月27日 00:42
2026年8月27日 00:42
访问原文

一周前,一位神秘模特名叫 Ox Alpha出现在OpenRouter上 - 400多款车型中又一款进入者,每周约有10款新车型推出。它脱颖而出的不仅仅是免费的价格标签;它安静地很好。爱好者和独立开发者很快注意到了这一点,每天都会通过它推送数万亿代币,社区对本周的估计范围从个位数到超过20万亿。 人工智能爱好者花了接下来的六天时间进行取证并猜测谁可以建造它,以及谁可以拥有免费提供这么多代币的基础设施。首先,猜测是一个美国实验室:期待已久的双子座,或者Anthropic运送足够好的中层,或者埃隆的容量太大,以至于放弃了Ox Alpha(请注意命名)。人们运行了tokenizer跟踪和网络分析。福尔摩斯探案周。 8月26日, Z.ai把它的名字放在上面 . Ox Alpha是GLM-5.3-Flash。他们故意在公共交通上运行它,但真正令人惊讶的不是这个模型有多好(它真的很好)。它完全由中国芯片和基础设施提供服务。挂牌价格为每百万个代币15美分/ 50美分。截至9月9日,OpenRouter的发布促销活动可享受50%的折扣,即7.5美分/ 25美分。权重是开放的(MIT),推断由Z.ai以及GMI Cloud、Cloudflare和其他美国推断提供商托管。 人工分析将模型放在他们的身上 情报与成本图表 于同日起GLM-5.3-Flash在指数上的着陆点为57点,每项任务约为9美分。像GPT-5.6 Sol(最大值)这样的美国中端产品大约为59,价格为67美分,这意味着你要为两个智能点支付大约7.4倍的费用。再进一步,Grok 4.6的价格是61美元,每项任务94美分,或者说是10倍,增加了4个点。在这一点上,代币经济学严重影响了消费计算。在顶端,曲线已经变平。如果我们接受这个开放重量的诱饵,我们疯狂的重型基础设施循环投资会发生什么

注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。

相关 AI 模型

新闻来源

venturebeat · 2026年8月27日 00:42

查看原文

相关新闻