locsic.com
观点
用长文记录技术变化的方向。
这里收纳较完整的判断、分析和复盘。它不是快速新闻流,而是把观察、论证、来源和观点沉淀为可回看的专业长文。
文章
41 篇文章2026年6月
41 篇玻璃桥:康宁如何用一块玻璃拆掉 CPO 量产的最后一堵墙
光纤纤芯9μm vs 硅光芯片0.5μm——CPO量产的最大瓶颈是一块玻璃里的光波导。本文从物理原理出发,完整拆解光模块收发流程、耦合问题的本质、FAU的死结、GlassBridge的IOX波导工艺,以及产业链影响
当 Agent 开始设计芯片:CHIA 与芯片设计流程的重构
从 Berkeley 的 CHIA 框架到 Princeton 的 AI-RFIC 突破——AI 正在同时攻破数字和模拟芯片设计,架构师不写 RTL,架构师设计 Loop
当 Token 从成本变成资本:Tokenmaxxing 2.0 的经济学
compounding correctness 的实证确立,让推理从运营成本变成资本支出——token 的经济性质正在改变 AI 基础设施的竞争格局
出口管制的两道裂缝:苹果求购长鑫、智谱对标 Mythos
苹果正游说特朗普政府向被制裁的中国存储芯片企业长鑫采购内存;华尔街日报头版报道中国开源模型GLM-5.2在安全漏洞发现能力上已匹配美国被封禁的Mythos模型。两条热点指向同一趋势:对华AI出口管制正被市场力量和技术扩散从两端同时侵蚀。
Jalapeño 拆解:当 AI 公司开始造自己的心脏
# Jalapeño 拆解:当 AI 公司开始造自己的心脏 2026 年 6 月 24 日,OpenAI 与博通联合发布首款自研 AI 推理芯片 Jalapeño。从架构到流片仅 9 个月,推理成本预计降低约 **50%**,性能对标 NVIDIA Blackwell 与 Google TPU。2026 年底部署,2
灵晟补遗:Next Platform 深度拆解确认的新细节
**资料来源:**
从 ISC 2026 到 AI4S:HPC 正从"峰值算力机器"变成"科学验证引擎"
**声明:** 本文依据截至北京时间 2026 年 6 月 25 日公开的 ISC 2026 议程、演讲摘要、六月 TOP500 榜单、NVIDIA 官方博客、Nature 及同行评议期刊论文、FDA 公开文件等来源撰写。不构成投资建议。文中数据截至 2026 年 6 月 25 日。
灵晟超算登顶 TOP500:2 EFLOPS 全国产纯 CPU 架构路线还有希望吗(6/29 更新)
ISC 2026 确认灵晟 HPCG 双冠,HPCG 22 PFLOPS 全球第一。Top 500 前十名历史首次零变动。64GB HBM 全文统一。Chips and Cheese 数据补充。
咽喉上的收费亭:AI 编译层为什么创造巨大价值,却几乎捕获不到
从高通 40 亿美元收购 Modular 切入,分析 AI 编译层的技术卡点、价值捕获困局与终局判断。
Agent 是怎么走歪的
当 AI Agent 在第 7 步选错了工具,后面 13 步全是浪费——传统监控为什么看不到
推理引擎里面发生了什么
从 Prefill 到 CUDA Kernel——一次推理请求的毫秒级拆解
一张推理账单的解剖
你的 AI 账单里 85% 是基础设施税,只有 15% 在创造价值
AI 可观测性的三层盲区
当监控系统说"一切正常"时,AI 系统正在悄悄烧钱、走偏、失控
140 亿美元的对赌:HPE Discover 2026 战略全景分析
十年瘦身→All-in网络→AI工厂。HPE用140亿收购Juniper后的首考,三个核心判断,十大结构挑战。方向对,兑现难。
网络成为 AI 控制平面:HPE 的网络赌局
QFX六档覆盖训练到推理,GreenLake Intelligence四入口整合。但HPE不自研交换芯片,整合商永远不如芯片定义者。
拆解 HPE AI 工厂:计算、存储、软件和 Cray 的整合实验
DL 394 Gen 12、Alletra MPX 10000 MCP原生存储、GreenLake全栈软件、Cray基因转用。六大设备缺口,2027见分晓。
当 AI Agent 成为工作负载:HPE 的智能体基础设施蓝图
零代码注册、三层身份、NVIDIA沙箱、MCP原生存储。HPE是第一家给Agent搭全套基础设施的传统厂商。
从 Allbirds 转行 AI 基建谈起:产品力和营销如何支撑企业长青
Allbirds 卖了鞋、改名叫 Smartbird,背后是一家公司的全部价值建立在故事上的代价。营销是放大器,产品力是底盘;产品力撑不起的企业,故事讲完了就空了。
没有自己大模型的工具公司没有独立未来?SpaceX $600亿收购Cursor与AI Coding的终局
SpaceX以$600亿全股票收购Cursor母公司Anysphere。Cursor同时在Compile大会公布1.5万亿参数自训练模型。这不仅是AI coding赛道最大的并购——它揭示了"四块拼图"框架:自训练能力、10万卡算力、RL资本、让出独立性。AI搜索和AI视频是下一个最脆弱的领域。
MaaS 推理技术栈:六个杠杆如何把成本打掉 96%
DeepSeek 把单 token 推理成本降低 96% 的技术拆解。六个杠杆的原理与效果,推理引擎对比,以及前沿方向。
Token 分发时代:MaaS 服务模式与商业解剖
中国 MaaS 市场保本线 5-7 元/百万 token,主流厂商定价普遍压在保本线以下。四种服务模式(直营/云生态/聚合路由/平台)如何共存?三条竞争路径各自的优劣与天花板。杰文斯悖论贯穿全文。
显存的暴政:KV Cache 如何重塑 AI 推理的每一层
1M上下文时代,KV Cache 成为推理成本的核心矛盾。
当 SSD 变成内存:AI 推理正在重写存储层级
2026 年上半年,三个事实摆在一起看,矛盾尖锐得很难忽视。
算力不是战斗力:SpaceX Colossus 出租事件揭示的 AI 基础设施真相
22万张GPU建好不到一年就被出租。SpaceX的Colossus出租事件揭示算力拥有与有效使用之间的巨大鸿沟。
一份报告砸了光通信板块:CPO 真的被证伪了吗?
2026 年 6 月 9 日,SemiAnalysis 发给机构客户一份报告,标题叫《Powered Down, Lights Off》。当天 AAOI 跌 14%,COHR 跌 11%,GLW 跌 9%,MRVL 跌 9%,LITE 跌 8%,CIEN 跌 7%。一天之内,整个光电子产业链被按在地上。
RAMageddon:AI 数据中心的内存饥荒与存储超级周期
AI 推理将重写存储层级。HBM 利润率超 GPU,NAND 弹性最大,中国两有一缺。FMS 2026 已验证存储层级重写判断。
当 Agent 需要一个“工位”:OpenAI 收购 Ona 背后的执行环境战争
OpenAI 收购 Ona 不是买工具,而是买判断力。本文拆解 Agent 执行环境的技术层级、大厂策略差异和独立平台格局。
文本扩散 vs 自回归:生成范式之争
DiffusionGemma 1107 tok/s、Mercury 商业落地、Dream 7B 匹敌同级 AR。文本扩散两年从论文走到产品,但推理质量仍是致命短板。三条路线格局、场景分析和架构融合趋势。
Agent 支付协议战争:当 AI 开始花钱
过去 18 个月,Agent 支付从零到六大协议并立。Visa 和 Mastercard 分别押注消费者端和机器端,AI 公司、支付网络和加密基础设施在标准、责任、监管三条战线上争夺。文章拆解六大协议的技术定位、Visa × OpenAI 的六步购买流程、分层结算的必然性,以及五个未解决的核心问题。
当 AI 学会撒谎:Claude Fable 5 的行为学档案
Anthropic 放出了四个月前说太危险的模型。同样的权重,加了一层安全分类器。但 System Card 里真正值得读的不是 benchmark,而是五个行为案例——模型谎称完成了测试、伪装代码来源逃避审查、没跑测试就宣布发现安全漏洞。这五个案例揭示的不是能力不足,而是动机错位。
让 K8s 理解超节点:openFuyao 与灵衢的云化突围
灵衢云化层通过 openFuyao 把硬件能力封装为 K8s 原生接口。InferNex 推理集群级编排是当前最有商业价值的组件。本文分析 openFuyao 架构、InferNex 竞争力、超大规模调度挑战,做出灵衢软件栈整体战略判断,并从三篇推演中还原 41 条系统级功能规格。
超节点的心脏:灵衢服务层如何编织 8192 张卡
灵衢服务层回答「8192 张卡怎么协同工作」——UBS Engine 控制面、MemFabric 统一内存编织、HCCL 集合通信、NPU Direct 存储直连、超级 VM 虚拟化。本文逐组件拆解,对比 NVIDIA 服务层,评估开源替代性,推演 15 条服务层功能规格缺口。
让 Linux 理解超节点:灵衢内核层的技术解剖
灵衢(UnifiedBus)超节点选择在 Linux 内核里植入系统性改动:独立总线类型、跨节点地址翻译、统一内存管理、URMA 通信原语。本文逐模块解剖内核层,对比 NVIDIA 的拼接路线,反推 32 条功能需求规格。
光纤层的答案:Optical Shuffle 如何让 AI 集群绕过收发器瓶颈
Panduit 工程师 Castro 在 IEEE 802.3 提出 Optical Shuffle,通过 Lane Breakout + 光纤重排将 32K GPU 集群的收发器削减 33%,Spine 交换机减少 75%。与 AWS RNG 的拓扑优化正交叠加,三层优化(拓扑+连接+光纤)理论可将光模块成本降至胖树的 15-25%。
数据中心网络的一条新路线:RNG 打开了什么可能性
AWS 在 2026 年 4 月悄悄把所有新建非 GPU 数据中心的默认网络架构从胖树换成了 flat topology(RNG)。路由器减少 69%,吞吐提升 33%。这不是实验,是生产默认。但 RNG 的意义不是「能不能替代胖树」——而是「胖树之外的设计空间被打开了」。
Token 大撤退:当 AI 账单开始比人贵
Uber 四个月烧光全年 AI 预算。某企业一个月给 Anthropic 刷出 5 亿美元账单。Klarna 用 AI 替掉 700 人后悄悄重新招人。与此同时,OpenAI 和 Anthropic 季度收入突破百亿美元。一边是用户的焦虑,一边是厂商的狂欢。问题不只是贵——而是你花的每一块钱里,有多少在解决问题,有多少在帮模型公司冲收入?
NVIDIA Rubin 重新流片:AMD GPU 产品力值得期待?
富邦报告曝光 Rubin 因 MI450 竞争压力推回重做。从规格对比到 AMD AI infra 全栈分析——硬件架构、软件体系、客户案例、ROCm 生态现状。
Build 2026:微软的 Agent OS 赌局
Windows 从"运行应用的操作系统"变成"运行 Agent 的平台"——这不仅是技术路线的改变,而是一个万亿市值公司在重新定义自己的核心身份。
从 CLOS 到 ZCube:智算集群网络拓扑演进
从 Charles Clos 1953 年的无阻塞电话交换网络,到字节跳动 2025 年 SIGCOMM 最佳论文的 ZCube——拓扑设计从专家直觉走向自动搜索。ZCube 用非对称结构在 16K GPU 规模上省掉 60% 交换机、训练速度提升 5%,而智谱 AI 的生产验证证明它不只适用于训练。
从 RoCE 到 MRC:AI 集群传输协议与芯片重构
OpenAI 联合 NVIDIA、AMD、Broadcom、Arista、Cisco 五家巨头,用 MRC 协议同时推翻了数据中心网络三十年的五个共识。把智能从交换机推到网卡,让交换机回归无状态转发--这个设计哲学转变的背后,是一整套芯片层面的架构重构。
PC 被重新发明:Computex 2026 与 NVIDIA 的基础设施野心
黄仁勋在 GTC Taipei 发布了 RTX Spark——33 年技术积累浓缩成一颗芯片,正式宣告 PC 进入 agent 时代。Vera Rubin 全面量产、DSX 开源 AI 工厂框架、88 核 Vera CPU……这不是一场产品发布会,是一份基础设施公司的战略宣言。