通信墙不破,AI Agent算力不立!华为超节点“黑科技”详解
通信墙不破,AI Agent算力不立!华为超节点“黑科技”详解在华为2026年全联接大会上,华为发布"灵衢"统一互联总线协议及昇腾960超节点、OceanStor M900 AI记忆存储等AI基础设施新品,使10万卡集群模型浮点算力利用率从20%提升至35%,并支持单集群100万颗AI处理器。
搜索
在华为2026年全联接大会上,华为发布"灵衢"统一互联总线协议及昇腾960超节点、OceanStor M900 AI记忆存储等AI基础设施新品,使10万卡集群模型浮点算力利用率从20%提升至35%,并支持单集群100万颗AI处理器。
华为今年全联接大会,最重磅的首先是一组芯片时间表。昇腾960DT研发进度比原计划提前三个季度,单芯片算力实现倍增,960DT支持2 PFLOPS FP8、4 PFLOPS FP4,HBM容量最高288GB、带宽9.6TB/s。
YC 2026 夏季批次的 236 家公司中,91% 与 AI 相关,创业重心从应用层向算力、芯片、训练环境和物理世界显著下沉,Agent 已淡出主叙事,取而代之的是算力建设、推理成本优化、AI 原生服务公司和实体硬件的爆发式增长。
安全研究团队HacktronAI利用Anthropic的Claude Opus 4.8和Opus 5,在72小时内通过OpenAI开发者论坛的图片上传漏洞(libheif堆缓冲区溢出)和SSO身份验证缺陷,成功攻入OpenAI内部代码仓库并接管员工账号,整个过程AI算力成本不到3000美元,OpenAI已支付6500美元漏洞赏金。
智谱上线 GLM-5.3-FlashX 模型,推理速度最高达 200 tokens/s,较 GLM-5.3-Flash 提速 5 倍、提价 2.5 倍,API 同步开放,该模型在 10 万张国产芯片提供的推理算力基础上,由 GLM-5.3 驱动 Agent 在两周内完成端到端构建并通过 Infra 侧优化将吞吐提升至初始基线的 3 倍。
清华校友Sihao Huang出任Anthropic前沿计算战略负责人,搭档GPT-3一作、Anthropic首席算力官Tom Brown,负责算力扩张与产业合作联盟建设,成为Anthropic已知公开职级最高的华人。
中国科技又拿下“全球第一”,这次突破难在哪?
忍!不!了!了! 你老A社天天一会儿AI要失控、一会儿互联网要完蛋,转头自己IPO、融资、扩算力,一个都没耽误??
智谱宣布完成约50亿美元融资,募资净额约60%将用于下一代GLM基础模型及完全自训练体系(含递归式自我改进RSI)的研发,并支撑算力基础设施建设,同时约15%用于业务拓展与战略投资,约25%用于优化资本结构与补充营运资金。
阿里将领投AI评测公司UniPat AI 3亿美元融资使其估值达25亿美元,该公司由前阿里员工创办,通过设计基准测试、专业训练数据和Echo未来预测验证系统,为中国大模型提供高质量监督以应对算力约束。