ECCV 2026|当RGB变成不可靠变量:InfraNet用非对称学习重构RGB-IR检测
ECCV 2026|当RGB变成不可靠变量:InfraNet用非对称学习重构RGB-IR检测在讨论 RGB-IR 目标检测时,「两种模态互补」几乎是默认前提。RGB 擅长保留纹理和颜色,红外图像在弱光条件下更稳定,于是最直接的路线是搭建双分支网络,让它们在中间层不断交换信息。InfraNet 的出发点却来自一个不太符合这一直觉的现象。
搜索
在讨论 RGB-IR 目标检测时,「两种模态互补」几乎是默认前提。RGB 擅长保留纹理和颜色,红外图像在弱光条件下更稳定,于是最直接的路线是搭建双分支网络,让它们在中间层不断交换信息。InfraNet 的出发点却来自一个不太符合这一直觉的现象。
极佳视界把一套完整的「通用世界模型」产品矩阵摆到了现场:从面向内容创作的一粟 YiSu,到面向自动驾驶数据与仿真的 DriveDreamer;从面向具身智能的 GigaWorld,到负责把世界理解转化为行动的 GigaBrain 与 GigaWorld-Policy;再到进入家庭场景的拾光 S1,以及面向智能制造的 Maker H01。
作为WAIC 2026最受关注的论坛,由商汤科技承办的“基座大模型架构创新与生态合作论坛”吸引了无数AI研究者、产业专家和投资机构的目光。因它直面了当前大模型行业最核心的焦虑:当Scaling Law在逼近物理极限,多模态究竟是破局的“解药”,还是新瓶装旧酒的延伸?
首次参展的 AI 原生企业与爱为舞,直接把一座开放式「AI 学习实验室」搬进了世博展览馆 H2-E505 展位。没有大屏循环播片,也不是观众站一圈看完就走。你是真的能坐下来,亲手一试:学习这件事,确实换了个打开方式。
来自港科大的研究团队提出了RepetitionCurse,这是一种针对MoE大模型服务的黑盒压力测试方法。它不需要模型权重,不需要梯度,也不需要知道后端专家如何部署,只利用高度重复的输入模式,就能诱导专家路由把大量token路由到同一小批专家上。
WAIC期间,中数睿智发布了“AI for Reasoning”因果智能体系,针对的就是这些痛点。比如油气钻井的井控场景,井下压力和流量突然不对劲,系统不只是输出一句“存在风险”,而是能沿因果链定位病因,并推演多条干预路径:不处置会怎样?立即关井会怎样?延迟处置能撑多久、代价是什么?辅助企业在事故发生前做出最优决策。
谁曾想呢,DeepSeek一直没有公开讲清楚的融资估值,被一家卖行李箱的公司给全部暴露了。7月16日晚间,安徽开润股份发布了一份投资进展公告。公告显示,开润股份参与投资的一只基金,已经将29亿元实缴资金全部间接投向DeepSeek,获得后者0.8265%的股权。
近日,国际权威咨询机构弗若斯特沙利文发布的《2025年全球具身智能与商用服务机器人独立市场研究报告》揭示了这样一个行业共识:商用服务领域,正是具身智能规模化落地的“第一战场”。
沐曦也把今年的新东西几乎一次性搬到了现场。曦景S600超节点首次亮相,单机柜64张GPU、可扩展至万卡集群;AI4S方向的曦索X300系列科学智能GPU首次发布;Agent体验区排起长队,数字员工、AI文创工作站几乎没停过。
Kimi K3 是一个 2.8 万亿参数模型,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
在刚刚过去的7月10日,韩国存储芯片巨头SK海力士正式登陆纽约纳斯达克交易所进行ADR挂牌,当日股价大涨 12.76%,盘中最高涨幅一度超过19%。此次IPO共融资265亿美元,刷新了阿里巴巴保持十余年的海外企业赴美融资纪录,也成为了美国历史上第二大股票发行,这也使得SK海力士的总市值超过1万亿美元。
在OpenAI开发者社区,苦这个旧搜索久矣: 终于能找到那条消息了,为什么拖了这么久;那个老搜索栏,从来就没好用过;会话一多,搜旧对话就变得不可能;翻旧对话简直成了噩梦……
直出8K长卷,中国AI还是首次!就在今天,WAIC大会上,商汤正式发布下一代「满血旗舰」——日日新SenseNova-U1 Pro。 这是业界头一回,把「看懂、生成、动手」原生做进了同一个多模态基座的底层。
上海人工智能实验室团队提出的Self-Harness,近期被LangChain CEO、联合创始人Harrison Chase转发,也被前OpenAI副总裁Lilian Weng收进自进化Agent相关博客。它盯上的不是换模型,而是Agent外层那套Harness。
这便是中国电信人工智能研究院(TeleAI),刚刚在WAIC 2026提出的新技术路线;其背后这套融合AI、通信和网络的技术体系,则是智传网(AI Flow)。就在此次发布前一天,智传网(AI Flow)还拿下了WAIC大会最高奖项卓越人工智能引领者奖(SAIL)中的赋能(Applicative)奖。
刚刚,钛动科技在 WAIC 上发布了 Navos 2.0,把多智能体产品从网页对话框升级为智能体工作流架构。本月初,钛动还与 OpenAI 正式达成了合作并签约。创始人兼 CEO 李述昊给公司取了两个词拼成的名字——Tec-Do(用技术做生意),后面挂着版本号 2.0,含义是「像做产品一样做公司」(Develop Company as Product)——Tec-Do 2.0。
7 月 16 日,伯克利博士后 Haven Feng 的一条推文火了。原因无他,结果很震撼:在 ARC-AGI-3 Public 集上,一套名为 [schema] 的智能体框架,与 Claude Opus 4.8、Fable 5 组合后达到 98.98% 的 RHAE;换成 GPT-5.6 Sol 组合,分数也有 95.35%。
7月17日晚,在2026世界人工智能大会(WAIC)举办期间,由腾讯新闻、腾讯科技主办,腾讯华东总部、腾讯云智能特别支持的“腾讯WAIC之夜”在上海举行。腾讯新闻负责人何毅进在活动现场发表致辞。
过去,大家围着国产芯片问的是,峰值算力多少?制程多少纳米?和英伟达相比差多少? 走到清微智能的展位前,你会发现一件有意思的事:这里摆的不只是芯片。可重构芯片、4K超节点、RAISA软件栈、行业应用,被放在一起呈现——像是在回答所有国产芯片厂商都绕不开的问题:
一项机器人拼搭长城的展示火爆全网。从彩排现场的照片来看,围观者已经里三层外三层。原力灵机联合阶跃星辰,用 6 台机器人挑战 15 小时连续作业,搭建完成一座包含超 8 万个零件的长城模型 —— 最小组件不到 1 厘米宽,成品长 3.5 米、宽 1.5 米、高 1.1 米。其中 4 台桌面机器人负责精细零件的拼装,2 台轮式机器人 Apex 负责将拼装完成的组件运输、组装。
这将是一个充满生产力的周末。就在刚刚,Claude 宣布当时时间 7 月 20 日起,Fable 5 继续留在所有 Max 和 Team Premium 套餐里,限额 50%。Pro 和 Team Standard 用户继续用积分访问,另外给用户发 100 美元的一次性积分。
7月15日,前谷歌DeepMind科学家Alex Turner宣布辞职。在一篇令人震惊的长文中,他揭露了谷歌如何一步步向五角大楼妥协,最终签下一份「毫无红线」的军事AI协议。以下,是Alex Turner用离职换来的惊人真相。
外媒Axios称,K3定价远低于它所挑战的高端模型,美国AI公司的高价策略还能维持多久?巧的是,就在最近,两大巨头正在打客户争夺战。此前,特曼在X上发帖,不提新模型,开头就是一句认错:
50多个智算中心,超过1000 EFLOPS的智能算力规模,平均利用效率却远远没有跑满。是石给出的解法,叫拓元(Vectron),一座国产Token优化工厂。是石科技依托国家级计算中心工程经验积淀,持续投入大规模集群研发,建设万卡级国产大集群,持续稳定运营,优化推理效率,构筑了深厚壁垒
WAIC(世界人工智能大会)第一天,信息量已经爆炸。从AI时代国家和企业的核心竞争力,到大模型迈向物理世界、迈向AGI所面临的挑战,再到Coding之后新的AI产品趋势……围绕从技术到产业的方方面面,图灵奖得主、两院院士、AI TOP研究者和企业、企业家们共聚一堂,精彩发声不断:
为了解决当前AI Agent存在的这些问题,面壁智能联合东北大学-面壁智能数据智能联合实验室、清华大学THUNLP实验室、OpenBMB与AI9Stars,正式开源了数字员工全流程构建与管理平台——StaffDeck。
WAIC 前夕,星尘智能(Astribot)新模型 Lumo-2,直接在官网甩出 20 + 真机视频 ——这背后,是星尘智能发布的第二代具身基座模型,也是业内首个面向家庭场景的隐式世界 - 动作模型(Latent World-Action Model),同步发的,还智能体 Agent Philia。
千寻智能的展台上,则来了两位画风完全不同的主角:一位是通体黑灰、看起来不苟言笑的 Moz1,埋头干活;另一位是首次公开亮相的 Moz2,奶杏色机身配上粉色小围脖「OOTD」,忙着向观众打招呼、举手比心,靠卖萌吸引了不少镜头。
RoboScience机器科学直接把世博馆展台,变成了 Visics 的压力测试场。换本体、换物品、换任务,多轮挑战轮番上阵,专挑具身大模型最容易掉链子的地方下手。Visics 的泛化能力究竟行不行?现场观众可以直接点题,围观验货。
7 月 14 日,Anthropic 正式发布 Claude for Teachers,面向美国 K12 教师免费开放高级功能,支持备课、课程设计、学习分析等教学场景。而在此之前,OpenAI 已经推出 ChatGPT for Teachers,同样聚焦教师教学支持,并计划向美国 K12 学区开放。