主 题:GLM 5.3 你是真牛逼吧
发 布 者:大鲨鱼
标签分类: 日常
时 间:2026-08-19 11:36:26
内容预览:首先大家对跑分不信任很大程度来自各家模型每次模型发布后,都会配上自己的跑分图,连豆包甚至都对标过 claude opus 和 gpt 5.5,下面全是小字营销,鬼知道它们怎么跑的此图为豆包模型发布时自己配的跑分图所以 Artificial Analysis 榜应运而生,谁也不惯着,而且测试项目严谨专业,如果你关注 ai ,你会发现很多测评博主和社区都会优先依据此榜单,目前为止较为权威的榜单了,基本代表了真实体验Artificial Analysis Terminal-Bench v2.1 跑分(最体现真实编程场景的权威测试)GLM 5.3 用 753B 参数,做到了比肩 kimi k3 的 2.8T 超大模型,仅仅是在 GLM5.2 的基础上进行了后训练,且价格不变!可能在 DeepSeek 眼里,这才是梁子想要 v4 pro 正式版达到的效果吧,可惜拉了坨大的,GLM 已经不屑于对标 DeepSeek 了(另外 DeepSeek v4 Pro 是 1.6T 大模型)这才是技术力的体现,不是靠堆参数来强行力大砖飞,力大砖飞的代价就是成本高,所以 kimi 贵,DeepSeek 涨OK,好的说完了,那么剩下该说:操你妈了
直达链接: https://www.nodeseek.com/post-882128-1
发 布 者:大鲨鱼
标签分类: 日常
时 间:2026-08-19 11:36:26
内容预览:首先大家对跑分不信任很大程度来自各家模型每次模型发布后,都会配上自己的跑分图,连豆包甚至都对标过 claude opus 和 gpt 5.5,下面全是小字营销,鬼知道它们怎么跑的此图为豆包模型发布时自己配的跑分图所以 Artificial Analysis 榜应运而生,谁也不惯着,而且测试项目严谨专业,如果你关注 ai ,你会发现很多测评博主和社区都会优先依据此榜单,目前为止较为权威的榜单了,基本代表了真实体验Artificial Analysis Terminal-Bench v2.1 跑分(最体现真实编程场景的权威测试)GLM 5.3 用 753B 参数,做到了比肩 kimi k3 的 2.8T 超大模型,仅仅是在 GLM5.2 的基础上进行了后训练,且价格不变!可能在 DeepSeek 眼里,这才是梁子想要 v4 pro 正式版达到的效果吧,可惜拉了坨大的,GLM 已经不屑于对标 DeepSeek 了(另外 DeepSeek v4 Pro 是 1.6T 大模型)这才是技术力的体现,不是靠堆参数来强行力大砖飞,力大砖飞的代价就是成本高,所以 kimi 贵,DeepSeek 涨OK,好的说完了,那么剩下该说:操你妈了
直达链接: https://www.nodeseek.com/post-882128-1