<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
	<channel>
		<title>技术随笔 on 苏然的博客</title>
		<link>https://bml.asia/tags/%E6%8A%80%E6%9C%AF%E9%9A%8F%E7%AC%94/</link>
		<description>Recent content in 技术随笔 on 苏然的博客</description>
		<generator>Hugo</generator>
		<language>zh-CN</language>
		
		
		
		
			<lastBuildDate>Thu, 17 Sep 2026 19:10:22 +0800</lastBuildDate>
		
			<atom:link href="https://bml.asia/tags/%E6%8A%80%E6%9C%AF%E9%9A%8F%E7%AC%94/index.xml" rel="self" type="application/rss+xml" />
			<item>
				<title>从 GLM-5.3-Flash 看 RSI：模型开始优化承载自己的系统了吗</title>
				<link>https://bml.asia/posts/glm-rsi-infra-agent/</link>
				<pubDate>Thu, 17 Sep 2026 19:08:18 +0800</pubDate>
				<guid>https://bml.asia/posts/glm-rsi-infra-agent/</guid>
				<description>&lt;p&gt;&lt;span style=&#34;text-indent:2em;display:block;&#34;&gt;如果有人告诉你，一套扛着生产流量的大模型推理系统，是另一个模型花两周时间调优出来的，你会不会觉得像段子？今天这件事成了官方口径，2026 年 9 月 17 日，智谱首席科学家唐杰在 X 上公布了团队在递归自我改进方向的首个工程化实践，由 GLM-5.3 驱动的 Infra Agent，用两周时间在超过 10 万颗国产 AI 加速器组成的集群上，完成了 GLM-5.3-Flash 推理基础设施的设计、调试与优化，从首次运行到稳定承载全部生产流量，端到端吞吐提升 3.2 倍。稍微补一下时间线，这个模型 8 月 26 日才以 MIT 协议开源，此前它顶着 Ox-Alpha 的匿名代号在 OpenCode 和 OpenRouter 上潜伏测试，六天处理了超过 62 万亿 token，一度成为两个平台上用量最高的模型之一。也就是说，一个刚刚开源、还在被社区评测的新模型，它的推理系统已经在很大程度上由另一个模型调优过了。&lt;/span&gt;&lt;/p&gt;</description>
			</item>
			<item>
				<title>曙光 ParaCache 与 KV Cache 之战</title>
				<link>https://bml.asia/posts/sugon-paracache-kvcache-analysis/</link>
				<pubDate>Fri, 28 Aug 2026 15:27:10 +0800</pubDate>
				<guid>https://bml.asia/posts/sugon-paracache-kvcache-analysis/</guid>
				<description>&lt;p&gt;　　中科曙光在数博会上推出了新一代词元加速方案 ParaCache，采用全国产化技术路线，并已在首个全国产十万卡 AI 超集群曙光 8000 的推理场景完成验证。要理解这个方案的价值，得先明白它打的是哪里——靶点是 &lt;strong&gt;KV Cache（键值缓存）&lt;/strong&gt;，而要解决的头号问题，官方表述得很直白：&amp;ldquo;中间结果调度和复用不畅导致的重复计算&amp;rdquo;。配合赛迪顾问报告里的判断，KV Cache 正成为存储系统的新型负载：长上下文、多轮交互、高并发推理让它的规模持续膨胀，既占显存，又拖慢响应和集群并发。&lt;/p&gt;</description>
			</item>
			<item>
				<title>AI 变成攻击者的武器了：一场关于网络安全的集体预警</title>
				<link>https://bml.asia/posts/ai-powered-cyber-defense-urgent-call/</link>
				<pubDate>Fri, 28 Aug 2026 06:40:35 +0800</pubDate>
				<guid>https://bml.asia/posts/ai-powered-cyber-defense-urgent-call/</guid>
				<description>&lt;p&gt;　　OpenAI、Anthropic、谷歌、微软,再加上 100 多家科技与金融服务机构,周四一起发了一封公开信,核心就一句话:把网络防御当成领导层的头号任务,赶紧修好软件里现存的漏洞。最扎眼的是这封信的联署阵容——平时这些公司各有立场、明争暗斗,如今能在网络安全上一致对外,本身就说明威胁已经到了让所有人都坐不住的地步。&lt;/p&gt;</description>
			</item>
			<item>
				<title>Linux 35 岁：没有公司、没有计划，却赢下了整个数字世界</title>
				<link>https://bml.asia/posts/linux-35-years-just-a-hobby/</link>
				<pubDate>Fri, 28 Aug 2026 01:19:38 +0800</pubDate>
				<guid>https://bml.asia/posts/linux-35-years-just-a-hobby/</guid>
				<description>&lt;p&gt;　　8 月 25 日刚过，Linux 迎来 35 岁生日。1991 年的那个夏天，21 岁的芬兰学生 Linus Torvalds 在 comp.os.minix 新闻组发了一封帖子，说自己正在写&amp;quot;一个类似 Minix 的免费操作系统&amp;quot;，末了补上一句著名的自嘲——&amp;ldquo;just a hobby, won&amp;rsquo;t be big and professional&amp;rdquo;。35 年后，全世界用最奢侈的方式回应了这句谦卑的自我介绍：从智能手机到超级计算机，从银行核心到太空探测器，他当年&amp;quot;玩玩而已&amp;quot;的那个系统，如今是支撑现代数字世界的底层地基。数字可以丈量这个奇迹的尺度：初始代码约 1 万行，如今超过 4000 万行，增长了约 4000 倍；连名字都是偶然——Linus 原本想叫它 Freax，是同事上传到服务器时自作主张改成了 Linux，一个随手起的名字，后来成了全球部署最广泛的操作系统内核。更了不起的是它的成长方式：没有一家公司、没有一个商业计划，靠的是全球几十万开发者&amp;quot;远程协作&amp;quot;式地一点点垒起来。任何一个角落的程序员，都能提交一行代码让它变得更好一点；这种没有总部、没有 KPI、甚至没有正式雇主的开发模式，最终跑赢了几乎所有商业操作系统。唯一没被攻克的战场是桌面——Linux 统治着服务器、手机、云和超级计算机，却在普通人的桌面屏幕上始终差一口气，这几乎成了它传奇里唯一的遗憾，也是它&amp;quot;不完美却真实&amp;quot;的注脚。&lt;/p&gt;</description>
			</item>
			<item>
				<title>Instant 团队加入 OpenAI，云托管将停，代码依旧开源</title>
				<link>https://bml.asia/posts/instant-team-joins-openai/</link>
				<pubDate>Mon, 24 Aug 2026 12:53:29 +0800</pubDate>
				<guid>https://bml.asia/posts/instant-team-joins-openai/</guid>
				<description>&lt;h2 id=&#34;一instant-是什么&#34;&gt;一、Instant 是什么&lt;/h2&gt;&#xA;&lt;p&gt;　　Instant（即 instantdb / instant）是一个主打“实时数据库 + 前端友好”的开发者工具。它把数据库、实时订阅、鉴权和文件存储打包成一套极简 API，让你在前端几行代码就能拿到一个会实时同步的后端。对于想快速做协作类、聊天类、看板类应用的独立开发者来说，它一度是 Firebase 之外很清爽的替代选择。&lt;/p&gt;</description>
			</item>
			<item>
				<title>放开赫尔墨斯 Agent 全部权限后，我看到了高效，也看到了风险</title>
				<link>https://bml.asia/posts/hermes-agent-unconstrained/</link>
				<pubDate>Mon, 24 Aug 2026 02:11:47 +0800</pubDate>
				<guid>https://bml.asia/posts/hermes-agent-unconstrained/</guid>
				<description>&lt;h2 id=&#34;第一章无约束赫尔墨斯-agent-实操体验&#34;&gt;第一章：无约束赫尔墨斯 Agent 实操体验&lt;/h2&gt;&#xA;&lt;p&gt;　　这段时间我把赫尔墨斯 Agent 的权限彻底放开：关闭人工询问弹窗、移除安全边界限制，人格管理、需求记忆、任务执行全部交给它全自动运行。实际体验很顺——丢一个需求过去，它自己拆解、自己调工具、自己迭代，中间不打断我，产出的结果也基本能用。这种&amp;quot;甩手不管&amp;quot;的流畅感，确实比每次都要点确认的传统助手高效太多，特别适合需要快速把想法落地的场景。&lt;/p&gt;</description>
			</item>
	</channel>
</rss>
