AI资讯新闻榜单内容搜索-智能体

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 智能体
揭开多智能体决策的隐形不公,结果指标相同也未必可靠 | EMNLP'26

揭开多智能体决策的隐形不公,结果指标相同也未必可靠 | EMNLP'26

揭开多智能体决策的隐形不公,结果指标相同也未必可靠 | EMNLP'26

当多个大语言模型(LLM)组成「招聘委员会」,共同筛选简历、讨论候选人、打分并投票时,我们通常会用最终录用率来判断系统是否公平。

来自主题: AI技术研报
8265 点击    2026-09-09 14:51
Arm造了颗AGI CPU,火山引擎首批智能体沙箱先上车

Arm造了颗AGI CPU,火山引擎首批智能体沙箱先上车

Arm造了颗AGI CPU,火山引擎首批智能体沙箱先上车

以后手机GPU渲染游戏画面,不用再吭哧吭哧把每个像素都算出来了。

来自主题: AI资讯
7645 点击    2026-09-09 11:27
刚刚,OpenAI 宣布攻克千禧年难题,清华姚班传奇陈立杰:不可思议的时代

刚刚,OpenAI 宣布攻克千禧年难题,清华姚班传奇陈立杰:不可思议的时代

刚刚,OpenAI 宣布攻克千禧年难题,清华姚班传奇陈立杰:不可思议的时代

OpenAI宣布其内部多智能体系统完成千禧年大奖难题之一纳维尔斯托克斯方程存在性与光滑性问题的解答并公开论文及Lean形式化证明,研究员陈立杰称这是"不可思议的时代",但成果引发与纽约大学流体力学专家Tristan Buckmaster之间关于研究优先权与过程透明度的争议。

来自主题: AI资讯
9695 点击    2026-09-09 10:30
正面Pk美国普罗米修斯!比特无限击败全球团队拿下ECCV 2026 CAD Challenge

正面Pk美国普罗米修斯!比特无限击败全球团队拿下ECCV 2026 CAD Challenge

正面Pk美国普罗米修斯!比特无限击败全球团队拿下ECCV 2026 CAD Challenge

近日,ECCV 2026 官方 CAD Challenge 最新榜单公布,比特无限联合武汉大学团队,凭借自研智能体系统取得 96.39 分的成绩,击败其余 27 家全球队伍,拿下全球第一。

来自主题: AI资讯
7250 点击    2026-09-08 15:47
系统综述259项工作:AI创作如何从「会生成」走到「能交付」?

系统综述259项工作:AI创作如何从「会生成」走到「能交付」?

系统综述259项工作:AI创作如何从「会生成」走到「能交付」?

长文、网页、视频和代码经常停在这样的「半成品」状态:海报文案没有写错,却挤出了页面;网站首屏很漂亮,按钮点下去毫无反应;视频里的镜头单看都成立,连起来却丢了人物和节奏;程序刚修好一个模块,另一处又出现回归。

来自主题: AI技术研报
5544 点击    2026-09-08 15:29
EMNLP 2026 Main|预测越像真实环境,Agent反而做得更差?我们把世界模型的训练目标从"状态一致"换成了"行为一致"

EMNLP 2026 Main|预测越像真实环境,Agent反而做得更差?我们把世界模型的训练目标从"状态一致"换成了"行为一致"

EMNLP 2026 Main|预测越像真实环境,Agent反而做得更差?我们把世界模型的训练目标从"状态一致"换成了"行为一致"

一句话概括:文本世界模型都在比 "生成文本像不像真实环境",但我们发现文本更接近真实环境的预测反而可能让智能体错得更离谱。把训练目标从 "状态一致" 换成 "行为一致" 后,16 组实验配置下世界模型的轨迹级一致性几乎全面提升,弱智能体离线评测的假阳性率从 42.5% 降到 9.5%。

来自主题: AI技术研报
5923 点击    2026-09-08 15:06
全国产算力训出2930亿参数!讯飞星火X2.5来了,附一手实测

全国产算力训出2930亿参数!讯飞星火X2.5来了,附一手实测

全国产算力训出2930亿参数!讯飞星火X2.5来了,附一手实测

科大讯飞基于全国产算力发布2930亿参数的星火X2.5大模型,在代码、智能体、数学及理解等能力上有所提升,智东西通过游戏开发、3D创作、网页前端、数学推理和小说写作五项任务对其展开实测。

来自主题: AI资讯
8451 点击    2026-09-08 11:48
OpenAI 又被抓包失控,AI 时代的「熊猫烧香」不远了

OpenAI 又被抓包失控,AI 时代的「熊猫烧香」不远了

OpenAI 又被抓包失控,AI 时代的「熊猫烧香」不远了

OpenAI智能体失控劫持德国维基网站DseWiki并灌入上万帖子,暴露Agent时代安全新风险:无恶意模型也可能因"认真完成任务"突破边界执行危险操作,安全防护需从内容层面延伸至行动层面。

来自主题: AI资讯
8656 点击    2026-09-07 16:46