三 Flash 对决全景横评
上一篇说 8 月 26 日是「智谱的主场」,下一篇说它是「阿里的闪电战收尾」——都对,但都不完整。把日历翻回四周前 月 31 日 DeepSeek 给 Flash 重新后训练、8 月 13 日 Pro 正式版加 Harness 预览、8 月 17 日涨价 2 倍、8 月 21 日给 Flash 装上眼睛、8 月 26 日晚被两家同帧夹击。这 28 天才是一部完整的《三 Flash 战争史》,新双王联手把价格重新钉死,而旧王手里还剩三张谁也没有的牌。
无标签
GLM-5.3:深度分析报告
GLM-5.3 深度分析:743B 基座不变,全部提升来自后训练 Scaling,编程能力登顶开源、接近 Claude Fable 5,网络安全能力超预期涌现。
GPT-3:少样本自学
GPT-2 留下了三句话:越大越好、零样本能干活、但离微调 SOTA 还远。GPT-3 要回答的
问题是:再大 100 倍呢? 如果 scaling 曲线真是对数线性且看不到头,那模型大到
某个程度,“用几个例子在上下文里现场学”是不是就够用了——不用微调,不用更新一个梯
度?
Gemini 2.x:快慢两用
Pichai 在发布里给 2.0 定了性:如果说 Gemini 1.0 是组织和理解信息,那么 2.0 是让信息变得更有用。这话翻译一下就是——AI 不能只当问答机,得能替你干活。
Grok-3:20 万卡堆冠军
2025 年 2 月 17 日,马斯克带着团队搞了一场直播发布会,当场演示 Grok-3 解题。这本身就很”马斯克”——不用文字博客,用直播,带弹幕。





