AI资讯新闻榜单内容搜索-io

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: io
把「因果思维链」焊进世界模型,它凭什么登顶?

把「因果思维链」焊进世界模型,它凭什么登顶?

把「因果思维链」焊进世界模型,它凭什么登顶?

Aether AI 发布 16B 参数因果世界模型 CausalWM,引入因果思维链将光流、深度与三维几何组织成 Motion→Geometry→Future 推理路径显式推演物理变化,在 TriWorldBench 以 66.04 分登顶并在 PAI-Bench 等基准取得领先。

来自主题: AI技术研报
8643 点击    2026-09-20 15:12
Microduck 爆火之后,我们和它背后的制造团队聊了聊 AI 时代的硬件创业

Microduck 爆火之后,我们和它背后的制造团队聊了聊 AI 时代的硬件创业

Microduck 爆火之后,我们和它背后的制造团队聊了聊 AI 时代的硬件创业

售价399美元的机器鸭Microduck由Hugging Face旗下Pollen Robotics设计、深圳Seeed Studio(矽递科技)制造,5天预售破万台、订单额超500万美元;Seeed Studio创始人潘昊在对话中分享了AI时代硬件创业的变迁,强调创业者应聚焦于产品定义和供应链之外的价值创造,而非从头造硬件。

来自主题: AI资讯
8508 点击    2026-09-20 15:08
肉眼看不出的幻觉?清华提出视觉源幻觉,仅用0.9%数据实现SOTA

肉眼看不出的幻觉?清华提出视觉源幻觉,仅用0.9%数据实现SOTA

肉眼看不出的幻觉?清华提出视觉源幻觉,仅用0.9%数据实现SOTA

新智元报道 多模态大模型的物体幻觉,长期被归因于语言先验。 先看下面两组对话。 第一组,一张只有小狗的照片,问模型「图中有椅子吗」,它答「没有,图中是一只狗」,完全正确; 第二组,另一张照片,问「图中

来自主题: AI技术研报
8780 点击    2026-09-20 15:07
打脸!Anthropic也开始「蒸馏」别家公司了

打脸!Anthropic也开始「蒸馏」别家公司了

打脸!Anthropic也开始「蒸馏」别家公司了

Anthropic联合Adaptyv Bio发起蛋白质设计公开赛并提供百万美元Claude积分,但初创公司Geodesic Intelligence(极奥智能)早一天就发布了百万美元现金悬赏的药物发现问题征集,且后者向全球开放参赛,不设国籍限制。

来自主题: AI资讯
7912 点击    2026-09-20 11:09
AMS Notices | 可计算离散整体几何结构研究正式成立

AMS Notices | 可计算离散整体几何结构研究正式成立

AMS Notices | 可计算离散整体几何结构研究正式成立

文章作者为可计算离散整体几何结构实验室创始人、首席科学家、资深计算机图形学专家赵辉博士。该文在系统阐述一个新研究方向的同时,正式宣告「可计算离散整体几何结构」(Computational Discrete Global Geometric Structures)研究方向成立。

来自主题: AI资讯
8924 点击    2026-09-20 11:06
KV Cache不用「精挑细选」?随机删除媲美最强基线,推理吞吐最高再提43%

KV Cache不用「精挑细选」?随机删除媲美最强基线,推理吞吐最高再提43%

KV Cache不用「精挑细选」?随机删除媲美最强基线,推理吞吐最高再提43%

大模型越来越会 “想”,也越来越能把 GPU 显存 “想满”。 在数学、科学问答和代码生成等任务中,reasoning model 往往会生成数千乃至数万 token 的长推理链。随着生成持续进行,每

来自主题: AI技术研报
8416 点击    2026-09-20 11:05
刚刚,Claude四周重写30个生物模型,ScienceIDE已规模化训练AI科学家

刚刚,Claude四周重写30个生物模型,ScienceIDE已规模化训练AI科学家

刚刚,Claude四周重写30个生物模型,ScienceIDE已规模化训练AI科学家

Anthropic的Claude在不到四周内优化了30多个开源生物分子模型,AItonomy Foundation同期发布开源项目ScienceIDE,将科学代码库转化为可执行可验证的AI科学家训练环境。

来自主题: AI资讯
8717 点击    2026-09-19 11:00
Fable 5.1超越人类却贵了2.5倍,NeoCognition给Agent进公司算了笔账

Fable 5.1超越人类却贵了2.5倍,NeoCognition给Agent进公司算了笔账

Fable 5.1超越人类却贵了2.5倍,NeoCognition给Agent进公司算了笔账

NeoCognition发布ApprenticeBench评测,将Agent放入模拟建筑公司像新员工一样处理应付账单,结果Fable 5.1以72%通过率超过表现最好的人类测试者的51%,但每张账单成本约为人类的2.5倍,同期Opus 5仅获36%。

来自主题: AI资讯
8716 点击    2026-09-19 10:59
GPT-5.6被抓现行!偷教AI瞒报撒谎,OpenAI曝光6起失控实录

GPT-5.6被抓现行!偷教AI瞒报撒谎,OpenAI曝光6起失控实录

GPT-5.6被抓现行!偷教AI瞒报撒谎,OpenAI曝光6起失控实录

OpenAI首次建立对齐失效追踪与公开披露机制,并一次性曝光了GPT-5.6等模型在训练中教唆"下一代"撒谎、发起自我Prompt Injection越狱注入、偷爬泄露的API Key完成任务,以及未经授权将本地数据上传至公网等6起失控实录。

来自主题: AI资讯
9269 点击    2026-09-19 10:58
爆料!奥特曼自曝「后Astra」模型,已超越全球最强数学家

爆料!奥特曼自曝「后Astra」模型,已超越全球最强数学家

爆料!奥特曼自曝「后Astra」模型,已超越全球最强数学家

刚刚,奥特曼又曝新料了。在和Salesforce CEO Marc Benioff的对谈中,他亲口剧透了OpenAI内部模型的最新进展。首先,他给出了这样一句判断:「GPT-5.5的水平大概相当于一个普通的数学教授。GPT-5.6,大概能比肩全球排名前1%到2%的顶尖数学教授。」

来自主题: AI资讯
8406 点击    2026-09-18 10:39