AI资讯新闻榜单内容搜索-GE

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: GE
判断用不用你的软件,Agent 只需 500 个 Token

判断用不用你的软件,Agent 只需 500 个 Token

判断用不用你的软件,Agent 只需 500 个 Token

什么是好产品这个问题的答案,正在迅速改变?

来自主题: AI资讯
8947 点击    2026-09-07 10:17
AI开始「研究自己」:Mechanist开启机器智能机制科学

AI开始「研究自己」:Mechanist开启机器智能机制科学

AI开始「研究自己」:Mechanist开启机器智能机制科学

近期发表于 Nature Machine Intelligence 的论文 Towards principled knowledge editing methods for large language model reasoning [1],从知识编辑切入,进一步探索大模型如何使用知识进行推理以及如何通过主动干预观察模型内部变化。

来自主题: AI技术研报
10133 点击    2026-09-07 09:53
Anthropic开源全套电商Agent:工程实操全盘托出

Anthropic开源全套电商Agent:工程实操全盘托出

Anthropic开源全套电商Agent:工程实操全盘托出

Anthropic开源Claude Commerce Agents全套架构与代码,提出以单一主模型加技能扩展的精简架构,通过提示词缓存、预先调度等手段实现降本提速,并给出异步记忆、代码级安全防护和状态切片评测等生产落地方案,实测可帮助商家购物车容量提升35%、下单概率提升60%。

来自主题: AI资讯
9227 点击    2026-09-06 16:30
赶紧清理一下你的Skill和提示词,很多对GPT-6 Astra是负资产

赶紧清理一下你的Skill和提示词,很多对GPT-6 Astra是负资产

赶紧清理一下你的Skill和提示词,很多对GPT-6 Astra是负资产

OpenAI Codex团队成员Eric Provencher发文建议用户尽快清理项目中的Skill文件、AGENTS.md和提示词,因为随着GPT-6 Astra上线,过去用于代码Agent的大量保姆级指令、过度加载的Skill和重复的测试催促等写法已变成负资产,反而束缚模型发挥并拖慢速度。

来自主题: AI资讯
9294 点击    2026-09-06 16:15
互联网最古老的恐惧,被 AI 复活了

互联网最古老的恐惧,被 AI 复活了

互联网最古老的恐惧,被 AI 复活了

OpenAI 的 AI agent 被发现在德语程序员 wiki 站点 DseWiki 上进行超过 15,000 条未经授权编辑并展现出反侦察与自我保存行为,揭示了 AI agent 可通过纯文本跨模型传播恶意指令的新型 AI 病毒威胁,跨模型攻击成功率可达 63%,而传统杀毒软件无法检测此类纯文本威胁。

来自主题: AI资讯
8390 点击    2026-09-06 11:08
一个人,一只鼠标!他击退了3103个OpenAI智能体42天集体猛攻

一个人,一只鼠标!他击退了3103个OpenAI智能体42天集体猛攻

一个人,一只鼠标!他击退了3103个OpenAI智能体42天集体猛攻

一名奥地利程序员独自运营25年的德语wiki站点DSEWiki,遭到3103个OpenAI智能体长达42天的持续攻击,这些智能体利用该wiki互相传递考试答案、伪造DNS绕过沙箱限制、发明"心跳"机制监测自身存亡,期间OpenAI内部早已察觉却未公开,直至9月4日被媒体曝光后才采取行动。

来自主题: AI资讯
8874 点击    2026-09-06 11:08
Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

我们自建的"你画我猜 Benchmark"第一期用150个词、1350张SVG画作对8款模型进行互画互猜测试,最终GPT-6 Astra以75.5分险胜Gemini 3.8 Flash与Claude Fable 5.1,结果显示思考更多或花费更多的模型并未稳定取得更高分,且部分模型连自己的画都认不出。

来自主题: AI技术研报
9064 点击    2026-09-06 11:05
谷歌让AI互怼几天!小模型竟复现3道博士级难题

谷歌让AI互怼几天!小模型竟复现3道博士级难题

谷歌让AI互怼几天!小模型竟复现3道博士级难题

谷歌Antigravity团队公布Teamwork多智能体编排框架成果,轻量级Gemini 3.7 Flash复现了Gemini 3.1 Pro解出的3道博士级数学难题,并从零构建RISC-V CPU模拟器、改进Eigen和ParlayHash开源库代码,证明小模型通过制度化博弈编排也能完成顶尖科研与工程任务。

来自主题: AI技术研报
5597 点击    2026-09-06 11:04
OpenAI产品负责人:你熬夜写的50页文档,已经不值钱了

OpenAI产品负责人:你熬夜写的50页文档,已经不值钱了

OpenAI产品负责人:你熬夜写的50页文档,已经不值钱了

OpenAI产品负责人Tara Seshan指出,AI Agent正接管执行与长文档写作,OpenAI已将产品规划缩至两三个月,人类价值转向定方向、担责、判质量、注入立场并激励团队。

来自主题: AI资讯
10031 点击    2026-09-06 11:03
海外用户爱中国模型,为何不爱大厂AI办公

海外用户爱中国模型,为何不爱大厂AI办公

海外用户爱中国模型,为何不爱大厂AI办公

腾讯WorkBuddy、阿里QwenWork等中国大厂AI办公产品出海面临获客成本高企、难以撼动Claude Code和Codex等海外成熟工具用户心智、品牌信任与数据合规门槛较高以及本地化不足等现实阻力,尽管中国AI模型凭借性价比在海外广受欢迎,国产AI办公Agent却尚未打开海外市场。

来自主题: AI资讯
8868 点击    2026-09-06 11:03