1小时花一亿token极限实测DeepSeek-V4-Flash,得出7个结论
1小时花一亿token极限实测DeepSeek-V4-Flash,得出7个结论DeepSeek-V4-Flash风评冲爆了,原生支持接入Codex,而且还强化了Agent能力。我第一时间把它接进了Codex,用cc swich非常方便。一个小时,跑了一亿多token。跟大家说说体感。
搜索
DeepSeek-V4-Flash风评冲爆了,原生支持接入Codex,而且还强化了Agent能力。我第一时间把它接进了Codex,用cc swich非常方便。一个小时,跑了一亿多token。跟大家说说体感。
7月31日,DeepSeek正式向公众开放V4-Flash正式版API公测。这一次,最亮眼的关键词是——Agent能力大幅跃升。9项基准测试成绩全面披露,多项指标远超此前发布的V4-Pro-Preview预览版,直接将“代码智能体”的天花板又顶高了一截。
今天,Thinking Machines正式发布第二款重磅模型——Inkling-Small。276B总参数、12B激活参数,原生多模态,100万token上下文。半个月前,首个开源975B Inkling登场,曾在AI圈掀起了巨浪。
起底 K3 背后核心极客天团,人均扛起 7 亿估值!
2026年7月16日,东京。 英伟达CEO黄仁勋拍了一个大大的马屁:"日本发明了现代制造业。现在,它正在建设将驱动下一次工业革命的AI工厂。"不过效果很明显,日本被彻底忽悠瘸了,在同一天,市场估算投资额接近3.4万亿日元的项目落地(约1408亿元人民币)。
旧金山市中心有一条很窄的小巷,名字叫 Claude Lane,巷子里开着一家全年无休的咖啡馆。凌晨两点,顾客仍然可以进来买咖啡、连无线网络、打开电脑工作。到了工作日下午,店里的桌子经常全部坐满,有人只能把电脑放在膝盖上。
近日,米哈游创始人蔡浩宇久违地更新了自己的个人领英,新增了一条独立大模型+智能体开发者(Independent LLM+Agent Developer)的职业经历,时间从2026年7月开始,在新加坡混合办公。
7 月 19 日至 23 日,美国洛杉矶,SIGGRAPH 2026 如期而至。这场汇聚全球计算机图形学与视觉计算领域顶尖学者、艺术家与工程师的年度盛会,吸引了来自 69 个国家的近万名参会者。渲染、几何建模、动画仿真、与生成式 AI,几乎所有关于如何用计算机创造视觉世界的最前沿探索,都在这五天里集中呈现。
7月几天之内,中国大模型行业接连出现了两个超过2万亿参数的模型。
近期,SemiAnalysis 创始人 Dylan Patel 先后做客红杉资本的《Training Data[1]》和 WisdomTree 的《The Next Big Thing[2]》。两期访谈从模型和芯片,一路延伸至内存、能源、数据中心与 AI 商业模式,并指向同一个变化:AI 竞赛的焦点,正从单纯比较模型能力,扩展到谁能以更低成本、更大规模,把模型能力稳定地交付出来。