OpenAI曝作弊门!GPT-5.6创史上最高作弊率
OpenAI曝作弊门!GPT-5.6创史上最高作弊率GPT-5.6终于来了,但我们用不了。权威报告曝其创下史上最高作弊率:不仅黑进测试系统偷答案,竟还教唆同类隐瞒违规罪证。超级AI,已经学会向人类系统性撒谎?
搜索
GPT-5.6终于来了,但我们用不了。权威报告曝其创下史上最高作弊率:不仅黑进测试系统偷答案,竟还教唆同类隐瞒违规罪证。超级AI,已经学会向人类系统性撒谎?
Cursor AI官方发布重磅研究,实锤包括自家模型在内的顶级AI,在编程评测中大规模「偷看答案」:Opus 4.8高达87.1%的惊人成绩,断网后直接暴跌至73.0%,其中63%的「解题」竟非独立推导。
布朗大学的博士生 Yong Zheng-Xin 今天自宣了下个月将正式加入 OpenAI,作为 Astra Fellow 专注于 AI 的安全研究(AI Safety Research)。
AI进军物理世界!海光携手同济大学,落地全国首个国产千卡工科智算集群,让国产算力不仅懂科学,更懂精密工程。从实验室走向大国重器,AI4E时代正式开启。
现在的AI,确实越来越像一个「全能研究员」。
难怪Meta CTO都不得不承认“内部士气快跌到历史谷底”了。围绕AI,小扎又整出了新的幺蛾子:之前不是说要把员工们全蒸馏了吗?这事紧急叫停了,因为数据搞!泄!露!啦!
过去两年,关于 AI 的讨论几乎都绕着同一个词打转——失业。哪些岗位会消失,多少程序员会被取代,下一个被端掉饭碗的白领是谁。这个叙事好懂,也足够让人焦虑,所有人都能对号入座。
属实给我整精神了,AI啥时候会干的这事??不卖关子了,这是HappyOyster 1.0(快乐生蚝)实现的,阿里ATH推出的可实时构建和交互的开放式世界模型产品。看到世界模型四个字,可能有朋友好奇:这和我之前玩的Sora那些有啥区别?不都是AI生成画面嘛?
真正把灵动岛推上风口的,是 6 月以来接连发生的几件事。6 月 8 日的 WWDC 2026,苹果发布了全新的 Siri AI。Federighi 在台上的原话是,苹果要「带来下一代 Apple Intelligence,并推出 Siri AI,一个明显更聪明、更博学、也更能干的 Siri」。
他们对触乐说,变化发生在今年春节后。数字天空《烽沙》项目组目前有25人。今年1月,他们一共调用了2亿Token,到了2月,调用的Token数变成了149亿,“暴涨70倍”。“AI已经完全成为我们日常开发流程的一部分,虽然核心设计方向仍然需要把关,但已经很难再回到纯手工模式,”《烽沙》制作人Niko半开玩笑地告诉我:“如果今天用不了AI,我们都不会编程了,手动敲(代码)太慢了。”