一个国产AI小透明,连续两次刷新NanoGPT Speedrun世界纪录
一个国产AI小透明,连续两次刷新NanoGPT Speedrun世界纪录家人们,我最近在GitHub上看到一个爽文。
搜索
家人们,我最近在GitHub上看到一个爽文。
如果你觉得 AI agent 离帮你订机票、填报销单、投简历只有一步之遥,那 MMLU-Pro 的作者联合滑铁卢大学 TIGER Lab,UBC NAIL Group 和 UniPat AI,CMU 等机构刚刚放出的这项研究,可能会让你冷静下来。
刚刚,OpenAI 宣布,ChatGPT 的广告的年化收入运行率(run rate)突破 10 亿美元。
硅谷顶级投资人,在a16z对话中给出判断—— Grok Bot,就是又一次ChatGPT时刻!
每月20美元的ChatGPT Plus都开了,还只拿它聊天?
文章以1955年麦卡锡等四人提交达特茅斯会议提案为起点,回顾人工智能学科诞生70年来的关键节点——符号主义与连接主义的兴衰、两次AI寒冬的成因与转机、2012年深度学习崛起、Transformer架构与ChatGPT引发的产业变革,指出AI发展是一条反复冲高与摔落的锯齿线,每一次寒冬皆因承诺跑得比能力快。
商汤首席科学家林达华在专访中判断,未来一两年多模态将迎来能力涌现的"GPT时刻",并阐述商汤以原生理解生成统一模型U系列和多模态智能体模型SenseNova 6.8为核心的长期技术路线。
ChatGPT Work于8月25日上线云浏览器登录功能,背后的云电脑配有约9个虚拟CPU和15GB内存,可在网页和手机端自动登录网站处理订狗粮、保险报销等任务,而密码对AI不可见,标志着该智能体首次跨越登录墙真正替用户办完事。
Salesforce AI与UIUC研究人员提出Strong-to-Weak Scaffolding方法,让强模型(Builder AI)为弱模型GPT-5.4-mini自动设计外部Harness工作框架,无需修改参数即可将其在心智理论任务上的平均准确率从0.488提升至最佳0.912,揭示AI4AI的核心机制是将认知结构而非知识从强模型迁移至弱模型。
趁着这个重置额度,做了几个小工具,今天要分享的就是其中一个。一个 Codex 桥接 ChatGPT 的 SKILL 技能,开源了。5.6 Sol 很强,在 Codex 桌面端拿它处理复杂任务,额度消耗得很快,特别是 Codex Plus 用户,已经恢复了5小时的窗口限制,稍微写一个复杂的技术方案,可能问几个问题,5小时的额度就干没了,这种体验很差。