<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
	<channel>
		<title>GLM-5.3 on 苏然的博客</title>
		<link>https://bml.asia/tags/glm-5.3/</link>
		<description>Recent content in GLM-5.3 on 苏然的博客</description>
		<generator>Hugo</generator>
		<language>zh-CN</language>
		
		
		
		
			<lastBuildDate>Thu, 17 Sep 2026 04:19:55 +0800</lastBuildDate>
		
			<atom:link href="https://bml.asia/tags/glm-5.3/index.xml" rel="self" type="application/rss+xml" />
			<item>
				<title>参数不涨了：智谱 2026 中期业绩里的技术路线转向</title>
				<link>https://bml.asia/posts/zhipu-ai-2026-interim-results/</link>
				<pubDate>Mon, 31 Aug 2026 23:47:46 +0800</pubDate>
				<guid>https://bml.asia/posts/zhipu-ai-2026-interim-results/</guid>
				<description>&lt;p&gt;　　这份中期业绩里最不像财务的一条信息是：GLM-5.3 与 GLM-5.2 用同一套基座，参数量没动，端到端编码完成率却提了 50% 以上。行业默认的能力跃迁方式是把基座做大，智谱这次放弃了它，把预算压到后训练上——扩大任务环境规模，拉长训练周期去磨。这不是省钱的妥协，而是一次判断：堆参数的边际收益在衰减，后训练才是眼下更陡的曲线。参数不变而能力上探，模型能力的来源正从“记得更多”转向“练得更久”。&lt;/p&gt;</description>
			</item>
			<item>
				<title>Ox Alpha 限免刷屏：我选择站在旁边看一会儿</title>
				<link>https://bml.asia/posts/ox-alpha-wait-and-see/</link>
				<pubDate>Tue, 25 Aug 2026 15:48:59 +0800</pubDate>
				<guid>https://bml.asia/posts/ox-alpha-wait-and-see/</guid>
				<description>&lt;p&gt;　　最近几天，OpenRouter 上冒出一个叫 &lt;strong&gt;Ox Alpha&lt;/strong&gt; 的匿名模型，中文社区顺口管它叫“牛来”——Ox 就是牛的意思。它 8 月 20 日夜里以 stealth 预览的形式上架，标着 $0/$0 的价、塞进 1M 的上下文、还能吃图文视频、支持工具调用，开发者 Ben Davis 拿 DeepSWE 编码基准给它跑出 80%，压过 Claude Fable 5 的 65% 和 GPT-5.6 Sol 的 52%。一时间“免费、能打、全网找爹”的标题铺满信息流，归属的矛头几乎齐刷刷指向智谱的 GLM-5.3：栈追踪泄露出 Zhipu 的接口路径、错误码对得上、分词器探针也高度吻合。故事讲得很圆，但我暂时按下不表，先把热闹里的几个问号摆出来。限免这件事本身就不承诺明天——IT之家说免费开放约一周，到 8 月 27 日前后就可能变天，OpenRouter 的 stealth 预览历来是“收反馈、攒声量、然后改价或下架”的套路，没有谁保证月底还能薅；而那个 80% 的跑分是个人 eval，不是官方基准，单点成绩好看，不代表综合全面碾压，这些水分得先滤掉再谈。&lt;/p&gt;</description>
			</item>
	</channel>
</rss>
