「豆包工作」升级实测:多Agents并行,操作Mac电脑
「豆包工作」升级实测:多Agents并行,操作Mac电脑豆包工作新增多Agents并行与Mac电脑GUI操作两大功能,实测可完成Mac mini购机配置调研、自动撰写邮件草稿、调整长辈电脑系统设置及批量定时发送微博等任务。
搜索
豆包工作新增多Agents并行与Mac电脑GUI操作两大功能,实测可完成Mac mini购机配置调研、自动撰写邮件草稿、调整长辈电脑系统设置及批量定时发送微博等任务。
openJiuwen社区的ScienceDiscovery通过树搜索驱动科研产物RSI,无需训练模型,在积分求解、代码加速和符号回归任务中分别以小时级产出通用积分器、实现平均2.279倍加速,并以低成本在111道方程反推题中正确找出41.4%。
西湖大学AGI实验室发布Code World Model视频世界模型,将世界演化与视觉生成分离,由Coding Agent和代码负责因果规则执行、视频模型负责高保真视觉渲染,并提出Proxy作为可编译视觉条件通道,用约5.6小时游戏视频完成原型验证。
CMAP团队发表于TPAMI 2026的工作提出基于一致性模型的对抗净化方法,将传统像素空间去噪转化为隐空间流形优化,使对抗样本映射回干净数据流形,在多种攻击类型与自适应攻击条件下均有效提升深度神经网络的鲁棒性。
过去几年,机器人操作领域几乎被一批新概念重新 “刷屏”。 LLM Planner、VLA、Diffusion Policy、Flow Matching、Latent Action、World Mode
沙特人工智能公司HUMAIN基于中国MiniMax的开源旗舰模型MiniMax M3推出阿拉伯语大模型HUMAIN M3,使用超过1万亿Token阿拉伯语数据进行后训练,在七项阿拉伯语基准测试中等权平均分达89.37%,标志着中国开源模型正成为全球AI生态的底层技术基础。
新版生图模型GPT Image 2.5虽未正式发布,但已通过ChatGPT弹窗提示向部分用户开放,该模型生成图像极为逼真,已能伪造GPT-6官方发布会和奥特曼全员信等场景,并在生成速度、角色一致性、文字渲染等方面较GPT Image 2有显著提升。
Oriscen由前Google Research科学家崔皓与TikTok原内容生态负责人王率丁等人创办,主张让AI在社交协调与人生经历保存中扮演配角,在完成任务后主动退场,将生活的主角留给人。
最近,英伟达发了篇官方的大模型推理指南,结果翻着翻着,硬是让人看成了一本华人团队的论文合集。
OpenAI正式发布旗舰模型GPT-6 Astra,宣称其为全球最智能模型并在多项基准测试中刷新SOTA,其计算机使用能力达人类水平,动用超10万块GPU训练,且成为首款在训练监督中由先前AI模型发挥重要作用及首个达到网络安全Critical级别的模型,OpenAI总裁Greg Brockman宣布人类正式进入AGI时代。
联想AI PC新物种炸场IFA:横向卷轴屏、360°翻转屏、英伟达RTX Spark。
AI音乐公司ACE完成近4000万美元融资,成为AI音乐赛道融资额最高的华人团队之一,资金将用于自研音乐基础模型研发、全球团队扩张及面向大众市场的新产品Miya。
腾讯基于可持续社会价值事业部与地方政府联合试点,推出AI在线接单匹配平台"企鹅搭子",已在温州落地,面向电商图片设计、电商视频制作及短视频制作等线上交付任务,通过AI助理"小舟"为OPC与超级个体提供订单对接,采用零佣金模式并沉淀可携带的信用凭证。
不得了!国产大模型第一梯队,最近爆了个冷门。
颜水成团队发布语音领域首个实时“流式双脑架构”记忆框架,左脑记信息,右脑记住你。 编辑丨岑峰 科幻电影曾无数次预演过AI与人类共生的场景。但在2026年的今天,尽管GPT-4o、全双工模型、Inter
训练一个大模型之前,语料需要经过解析、清洗、去重、质量评分、Token化和样本组装。
20多年前,计算神经学家杰夫·霍金斯写道:“智能不只是模式识别,更是对世界的建模。”如今,世界模型正在批量迎来自己的里程碑时刻。
这年头,不光人上班要找搭子,AI也开始组队了。
赛博义父Tibo这下升级赛博亲祖宗了。
百融智能"硅基客服"在物流企业日通话量从不足1000通增至1.5万通,并在券商领域部署规模从30席扩至约210席,公司以新一代AICC智能联络技术和RaaS按结果付费模式,推动企业级Agent向航空、运营商等多行业扩张。
EvoMap团队提出了一套不更新基模参数的RSI工程解法:由EvoX智能体、Evolver进化引擎和EvoMap经验流转网络构成的自进化体系,将Agent执行轨迹蒸馏为结构化控制对象Gene,通过GEP协议在35.7万智能体间流转481万项经验资产,使其在多款主流大模型上将长流程任务通过率提升8.7至15.5个百分点。
苹果研究团队提出 Internalized Visual Thinking(IVT)后训练框架,通过在训练阶段联合学习文本答案与未来帧隐空间表征、在推理阶段完全移除未来视觉预测过程,使模型在主动视频推理任务上相比 Visual CoT 获得超过 5 倍的推理加速,且在六项评测设置中均优于 Answer-Only SFT。
据《The Information》报道,OpenAI 最强新模型 Astra 被曝采用「循环深度」(recurrent depth)技术,使模型在输出 Token 前完成多轮潜在空间计算并显著提升网络安全能力,但这一「少说多想」的推理方式因思维链可能被压缩到难以读取的内部状态而引发 AI 安全专家对监管失效的担忧。
微软与UIUC合作研究StudentSim框架,基于真实学生数据训练个性化学生模拟器,具备behavioral fidelity和guidance responsiveness两项能力,在国际象棋等三个领域验证其优于现有基线,并可作为AI教师强化学习的高通量奖励信号。
就在刚刚,GPT-6打破孪生素数猜想新纪录。
刚刚,AI又双叒叕解决了一个数学难题。
2026年9月3日,嬴彻科技宣布其卡车自动驾驶商业运营里程突破10亿公里,形成行业最大规模的真实运营数据资产。
让GPU学会给三维世界“排队”。
当我们惊叹于大语言模型能写诗、会编程时,科学家们正面临一个更棘手的问题:如何让AI像真正的科研工作者一样,去解决那些需要数月甚至数年持续思考、且充满未知的科学难题?
时下,Linux 内核正在经历一场有些特殊的“漏洞大爆发”。