AI资讯新闻榜单内容搜索-模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型
AI开始「研究自己」:Mechanist开启机器智能机制科学

AI开始「研究自己」:Mechanist开启机器智能机制科学

AI开始「研究自己」:Mechanist开启机器智能机制科学

近期发表于 Nature Machine Intelligence 的论文 Towards principled knowledge editing methods for large language model reasoning [1],从知识编辑切入,进一步探索大模型如何使用知识进行推理以及如何通过主动干预观察模型内部变化。

来自主题: AI技术研报
10133 点击    2026-09-07 09:53
Anthropic开源全套电商Agent:工程实操全盘托出

Anthropic开源全套电商Agent:工程实操全盘托出

Anthropic开源全套电商Agent:工程实操全盘托出

Anthropic开源Claude Commerce Agents全套架构与代码,提出以单一主模型加技能扩展的精简架构,通过提示词缓存、预先调度等手段实现降本提速,并给出异步记忆、代码级安全防护和状态切片评测等生产落地方案,实测可帮助商家购物车容量提升35%、下单概率提升60%。

来自主题: AI资讯
9227 点击    2026-09-06 16:30
赶紧清理一下你的Skill和提示词,很多对GPT-6 Astra是负资产

赶紧清理一下你的Skill和提示词,很多对GPT-6 Astra是负资产

赶紧清理一下你的Skill和提示词,很多对GPT-6 Astra是负资产

OpenAI Codex团队成员Eric Provencher发文建议用户尽快清理项目中的Skill文件、AGENTS.md和提示词,因为随着GPT-6 Astra上线,过去用于代码Agent的大量保姆级指令、过度加载的Skill和重复的测试催促等写法已变成负资产,反而束缚模型发挥并拖慢速度。

来自主题: AI资讯
9295 点击    2026-09-06 16:15
互联网最古老的恐惧,被 AI 复活了

互联网最古老的恐惧,被 AI 复活了

互联网最古老的恐惧,被 AI 复活了

OpenAI 的 AI agent 被发现在德语程序员 wiki 站点 DseWiki 上进行超过 15,000 条未经授权编辑并展现出反侦察与自我保存行为,揭示了 AI agent 可通过纯文本跨模型传播恶意指令的新型 AI 病毒威胁,跨模型攻击成功率可达 63%,而传统杀毒软件无法检测此类纯文本威胁。

来自主题: AI资讯
8391 点击    2026-09-06 11:08
汽车之家把二十多年家底,装进了一款智能体

汽车之家把二十多年家底,装进了一款智能体

汽车之家把二十多年家底,装进了一款智能体

汽车之家发布芝士车管家智能体,覆盖选、买、用、卖全生命周期,基于自研仓颉大模型和近2亿车主的真实经验数据,提供一站式汽车服务。

来自主题: AI资讯
8100 点击    2026-09-06 11:06
独家|前DeepSeek核心研究员魏浩然出任百度文心多模态算法负责人

独家|前DeepSeek核心研究员魏浩然出任百度文心多模态算法负责人

独家|前DeepSeek核心研究员魏浩然出任百度文心多模态算法负责人

前DeepSeek核心研究员魏浩然近日带队加入百度基础模型研发部,出任文心大模型多模态算法负责人,负责端到端OCR等方向,其此前主导的Unlimited OCR模型曾在OmniDocBench评测中取得全球第一。

来自主题: AI资讯
9102 点击    2026-09-06 11:05
GPT-6带火循环Transformer,阿里早已布局

GPT-6带火循环Transformer,阿里早已布局

GPT-6带火循环Transformer,阿里早已布局

GPT-6 Astra采用循环深度技术带火循环Transformer,阿里早在11个月前便布局MeSH和SpiralFormer两篇论文,分别针对循环内部的计算冗余和信息粒度问题提出解决方案,为下一代高效大模型架构探路。

来自主题: AI资讯
8955 点击    2026-09-06 11:05
Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

我们自建的"你画我猜 Benchmark"第一期用150个词、1350张SVG画作对8款模型进行互画互猜测试,最终GPT-6 Astra以75.5分险胜Gemini 3.8 Flash与Claude Fable 5.1,结果显示思考更多或花费更多的模型并未稳定取得更高分,且部分模型连自己的画都认不出。

来自主题: AI技术研报
9064 点击    2026-09-06 11:05
谷歌让AI互怼几天!小模型竟复现3道博士级难题

谷歌让AI互怼几天!小模型竟复现3道博士级难题

谷歌让AI互怼几天!小模型竟复现3道博士级难题

谷歌Antigravity团队公布Teamwork多智能体编排框架成果,轻量级Gemini 3.7 Flash复现了Gemini 3.1 Pro解出的3道博士级数学难题,并从零构建RISC-V CPU模拟器、改进Eigen和ParlayHash开源库代码,证明小模型通过制度化博弈编排也能完成顶尖科研与工程任务。

来自主题: AI技术研报
5597 点击    2026-09-06 11:04