系统综述259项工作:AI创作如何从「会生成」走到「能交付」?
系统综述259项工作:AI创作如何从「会生成」走到「能交付」?长文、网页、视频和代码经常停在这样的「半成品」状态:海报文案没有写错,却挤出了页面;网站首屏很漂亮,按钮点下去毫无反应;视频里的镜头单看都成立,连起来却丢了人物和节奏;程序刚修好一个模块,另一处又出现回归。
搜索
长文、网页、视频和代码经常停在这样的「半成品」状态:海报文案没有写错,却挤出了页面;网站首屏很漂亮,按钮点下去毫无反应;视频里的镜头单看都成立,连起来却丢了人物和节奏;程序刚修好一个模块,另一处又出现回归。
北京航空航天大学史振威与邹征夏教授团队开发了面向广域地球观测的生成式基础模型MetaEarth3D,只需给定文字或卫星图即可生成无界连续一致的三维世界场景,并自带空间标注使空天AI模型空间理解能力平均提升22.85%。
AI云计算提供商Crusoe完成超30亿美元融资,估值达300亿美元,本轮由Atreides Management与Valor Equity Partners共同领投,Mubadala Capital参投。
ECCV 2026论文ART由vivo BlueImage Lab联合哈工大与南大提出,通过将真实参考图作为可微分监督信号的两阶段训练框架,突破了复杂妆容迁移中的伪目标天花板,同步发布了首个2K分辨率妆容数据集MF2K。
AI智能体基础设施公司以太之心(AetherHeart)凭借Aeloon智能体与AetherStation边缘一体机产品,近日完成由上海天使会、浦东创投、高信资本及天使清芬参投的数千万种子轮融资。
不得了!国产大模型第一梯队,最近爆了个冷门。
Meta推出实时音频感知模型Muse Voice Transcribe,支持超20位说话人分割与超1小时长音频转写,可无缝切换中英文夹杂表达,在Artificial Analysis流式语音转文本基准测试中排名第一。
现在的 AI 生图有点太强,像 images 2.0 这样的模型,一段 Prompt 敲进去,直接逼真到你怀疑现实的一切。
Full Attention 层尚未开始计算,它前一层的激活值已提前「冲上峰值」—— 这就像演唱会主角尚未登台,观众席已提前沸腾。来自 StartLux、清华大学等机构的研究者以 Massive Activations 为探针,首次系统刻画了少数 Full Attention 层在混合线性注意力大模型中留下的「跨层痕迹」,并识别出「注意力前尖峰」(PAS)与「尖峰间平台」(ISP)两种核心形态。
Lovart正式开启中国区运营并同步上线新版本,主打"Just Design"理念,新增灵感采集插件、100个专业Skill工作流及一键转矢量等功能,支持图片、视频、动效、可交互HTML及PPT等多种格式输出。