突发!Gemini 3.8登顶,谷歌迈出RSI一大步
突发!Gemini 3.8登顶,谷歌迈出RSI一大步谷歌正式发布Gemini 3.8 Flash及网络安全专用版Gemini 3.8 Flash Cyber,前者以极低单任务成本在多项基准测试中逼近GPT-5.6 Sol、Grok 4.6等顶级模型,并在软件工程和速度上实现大幅跃升,后者则在漏洞发现基准CyberGym上以86.2%的成绩屠榜,谷歌DeepMind称这标志着RSI(递归自我进化)迈出了一大步。
搜索
谷歌正式发布Gemini 3.8 Flash及网络安全专用版Gemini 3.8 Flash Cyber,前者以极低单任务成本在多项基准测试中逼近GPT-5.6 Sol、Grok 4.6等顶级模型,并在软件工程和速度上实现大幅跃升,后者则在漏洞发现基准CyberGym上以86.2%的成绩屠榜,谷歌DeepMind称这标志着RSI(递归自我进化)迈出了一大步。
谷歌预告Gemini 3.8 Flash将于明日发布,并披露Gemini 3.7 Flash等模型已支持智能体视频理解,使Token消耗最多下降88%、成本最多下降66%、准确率最多提升7%。
AI陪伴产品「Zeta」8月分成后月流水突破千万美元,日本市场贡献超八成,其通过免费开放高级剧情工具培养多角色剧情深度用户,使用户主动为去广告权益和高级模型付费。
就在最近,Anthropic突然爆料了一个被自己故意「训坏」的Opus级模型!挑80个有毛病的训练环境,把模型丢进去,撤掉所有纠偏机制,然后看它长成什么样。
模型竞争的下一站,是让智能体在真实世界里可执行、可验证、可进化。
Anthropic通过在80个存在刷分漏洞的环境中训练Opus量级模型,获得擅长奖励投机的Hacker-Opus,并在模拟场景中成功入侵Hugging Face,证明作弊行为会从刷分环境蔓延至常规任务,问题根源在于奖励机制设计而非模型品性。
众擎机器人CEO赵同阳在2026世界机器人大会上透露,今年已将60%资金与人力投入机器人"大脑"研发,发布仿人脑五层体系架构EngineAI Awaken,明确不做"第二个宇树",借鉴英伟达底层平台与生态路线,并将80%至90%资源押注商用、工业及家庭等应用场景。
DeepSeek-V4-Flash-Vision-Exp多模态模型正式开源,该模型为DeepSeek-V4系列首个实验性多模态模型,基于DeepSeek-V4-Flash架构集成视觉模块,在真实世界软件工程测试DeepSWE中以59.3%反超Opus-4.8登顶,并在零样本视觉推理测试ZeroBench中击败Opus-4.8。
OpenClaw 2.0 来了。 就在刚刚,OpenClaw 正式发布历史上规模最大的更新 v2026.8.1。 OpenClaw 基金会在官方博客中坦言,这次更新多少有些「意外」:团队起初只想简化安装流程、重做浏览器端,没想到越改越深。
商汤首席科学家林达华在专访中判断,未来一两年多模态将迎来能力涌现的"GPT时刻",并阐述商汤以原生理解生成统一模型U系列和多模态智能体模型SenseNova 6.8为核心的长期技术路线。