AI资讯新闻榜单内容搜索-2

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 2
刚刚,机器人首次「空手闯进」 30 个陌生家庭,进门就干活

刚刚,机器人首次「空手闯进」 30 个陌生家庭,进门就干活

刚刚,机器人首次「空手闯进」 30 个陌生家庭,进门就干活

Figure AI发布新一代模型Helix 2.5,在30个从未采集过数据的湾区民宅中进行零样本测试,420次试验成功237次,零样本成功率达56%,较未经Index预训练的策略的9%提升超过522%。

来自主题: AI资讯
8272 点击    2026-09-19 10:59
Fable 5.1超越人类却贵了2.5倍,NeoCognition给Agent进公司算了笔账

Fable 5.1超越人类却贵了2.5倍,NeoCognition给Agent进公司算了笔账

Fable 5.1超越人类却贵了2.5倍,NeoCognition给Agent进公司算了笔账

NeoCognition发布ApprenticeBench评测,将Agent放入模拟建筑公司像新员工一样处理应付账单,结果Fable 5.1以72%通过率超过表现最好的人类测试者的51%,但每张账单成本约为人类的2.5倍,同期Opus 5仅获36%。

来自主题: AI资讯
8714 点击    2026-09-19 10:59
AGI新战场谷歌亚马逊巨头激战,杀出个中国LimiX-2赢了又赢

AGI新战场谷歌亚马逊巨头激战,杀出个中国LimiX-2赢了又赢

AGI新战场谷歌亚马逊巨头激战,杀出个中国LimiX-2赢了又赢

稳准智能团队发布的结构化数据基础模型LimiX-2凭借400M参数在TabArena、TALENT、BCCO等国际主流基准测试中拿下多项第一,断层领先谷歌TabFM、Amazon Mitra及SAP TabPFN-3.5等模型。

来自主题: AI资讯
8327 点击    2026-09-19 10:59
不只强在硬件!宇树6B具身大脑拿下7项开源SOTA,对标GPT-6 Astra

不只强在硬件!宇树6B具身大脑拿下7项开源SOTA,对标GPT-6 Astra

不只强在硬件!宇树6B具身大脑拿下7项开源SOTA,对标GPT-6 Astra

宇树科技发布6B参数通用人形机器人基础模型UnifoLM-WLA-1.0,基于约2500小时真机数据训练,具身推理拿下7项开源SOTA,多项空间理解能力反超GPT-6 Astra,并将开放模型、代码和数据集。

来自主题: AI资讯
9319 点击    2026-09-19 10:58
YC 最新投资的 236 家公司:“几乎所有事情都不一样了”

YC 最新投资的 236 家公司:“几乎所有事情都不一样了”

YC 最新投资的 236 家公司:“几乎所有事情都不一样了”

YC 2026 夏季批次的 236 家公司中,91% 与 AI 相关,创业重心从应用层向算力、芯片、训练环境和物理世界显著下沉,Agent 已淡出主叙事,取而代之的是算力建设、推理成本优化、AI 原生服务公司和实体硬件的爆发式增长。

来自主题: AI资讯
10257 点击    2026-09-19 10:58
OpenAI服务器被黑!3人用Claude打进了内部代码仓库

OpenAI服务器被黑!3人用Claude打进了内部代码仓库

OpenAI服务器被黑!3人用Claude打进了内部代码仓库

安全研究团队HacktronAI利用Anthropic的Claude Opus 4.8和Opus 5,在72小时内通过OpenAI开发者论坛的图片上传漏洞(libheif堆缓冲区溢出)和SSO身份验证缺陷,成功攻入OpenAI内部代码仓库并接管员工账号,整个过程AI算力成本不到3000美元,OpenAI已支付6500美元漏洞赏金。

来自主题: AI资讯
9591 点击    2026-09-19 10:57
jina-ocr-v1:在低成本 GPU 上更快解析文档

jina-ocr-v1:在低成本 GPU 上更快解析文档

jina-ocr-v1:在低成本 GPU 上更快解析文档

Jina AI 发布端到端文档解析模型 jina-ocr-v1,以 3.4B 总参数/570M 激活参数在 OmniDocBench v1.6 与 olmOCR-Bench 上刷新同级别最佳成绩,并凭借 FastMTP 推测解码与分级密集奖励在低成本 GPU 上实现无损近倍速生成,单页仅输出 1085 个 token 以 2.57 页/秒吞吐领跑 14 款主流系统。

来自主题: AI资讯
9101 点击    2026-09-18 17:29
全模态模型Qwen3.8-Omni-Flash发布

全模态模型Qwen3.8-Omni-Flash发布

全模态模型Qwen3.8-Omni-Flash发布

原生全模态模型Qwen3.8-Omni-Flash正式上线千问AI平台,支持文本、图像、音频、视频输入及1M长上下文,在30项评测中平均得分较上一代Qwen3.5-Omni-Plus提升超26%,在音视频Agent、剪辑、创作等场景效果显著,API每小时音频输入价格降幅超98%。

来自主题: AI资讯
8789 点击    2026-09-18 17:29
GLM-5.3-FlashX 上线:200 tokens/s

GLM-5.3-FlashX 上线:200 tokens/s

GLM-5.3-FlashX 上线:200 tokens/s

智谱上线 GLM-5.3-FlashX 模型,推理速度最高达 200 tokens/s,较 GLM-5.3-Flash 提速 5 倍、提价 2.5 倍,API 同步开放,该模型在 10 万张国产芯片提供的推理算力基础上,由 GLM-5.3 驱动 Agent 在两周内完成端到端构建并通过 Infra 侧优化将吞吐提升至初始基线的 3 倍。

来自主题: AI资讯
8468 点击    2026-09-18 15:49
豆包大模型再更新,发力多模态编程,一手实测来了

豆包大模型再更新,发力多模态编程,一手实测来了

豆包大模型再更新,发力多模态编程,一手实测来了

字节跳动发布新版豆包2.1 Pro(0915版本),重点升级多模态编程与视觉理解能力,可依据设计图、图纸和操作录屏生成代码,编辑团队通过山西3D旅行导览、小王子微缩星球等场景实测,验证其在Agent任务交付与Token效率方面的提升。

来自主题: AI资讯
7727 点击    2026-09-18 15:48