AI资讯新闻榜单内容搜索-多模态

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 多模态
全世界最强的AI,都在“抄”这群普通人的作业

全世界最强的AI,都在“抄”这群普通人的作业

全世界最强的AI,都在“抄”这群普通人的作业

这两天,AI圈百家争鸣。GPT-6曝光、DeepSeek V4 Flash公测、SD2.5发布、MiniMax多模态开源视频模型发布……

来自主题: AI资讯
10735 点击    2026-08-03 11:01
JarvisHub:让创作Agent走出聊天框——面向长程多模态创作的开源画布原生Harness

JarvisHub:让创作Agent走出聊天框——面向长程多模态创作的开源画布原生Harness

JarvisHub:让创作Agent走出聊天框——面向长程多模态创作的开源画布原生Harness

JarvisHub 给出的答案,是把可编辑画布同时变成用户工作区、Agent 的外部记忆、行动空间和共享项目状态。Agent 不再只从聊天记录里猜测上下文,而是直接「看」到画布上的提示词、参考图、候选版本、生成结果、依赖关系、失败记录和用户反馈,再据此规划、调用工具、写回结果。

来自主题: AI资讯
9040 点击    2026-08-02 11:09
只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大

只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大

只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大

目前,这项技术已成功应用于上海人工智能实验室Intern-S2-Preview 35B/397B系列多模态大模型的预训练中,有效提升了模型的科学推理与多模态理解能力。值得一提的是,相关研发均基于国产昇腾算力平台完成,并成功实现了面向大规模预训练的深度适配与优化。

来自主题: AI技术研报
8521 点击    2026-08-01 10:45
翁荔刚回OpenAI,Thinking Machines反手发布新模型Inkling-Small

翁荔刚回OpenAI,Thinking Machines反手发布新模型Inkling-Small

翁荔刚回OpenAI,Thinking Machines反手发布新模型Inkling-Small

今天,Thinking Machines正式发布第二款重磅模型——Inkling-Small。276B总参数、12B激活参数,原生多模态,100万token上下文。半个月前,首个开源975B Inkling登场,曾在AI圈掀起了巨浪。

来自主题: AI资讯
9235 点击    2026-07-31 13:35
MiniMax H3:打破任务和模态边界的开放模型

MiniMax H3:打破任务和模态边界的开放模型

MiniMax H3:打破任务和模态边界的开放模型

今天,我们正式发布 MiniMax H3。这是一款通用的全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率。

来自主题: AI资讯
6466 点击    2026-07-31 11:14
模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

近几年,多模态生成模型进步很快。一句指令就能生成图片、视频、音频、网页、UI、分镜,甚至整套演示文稿。只看成品,创作门槛似乎已经大幅降低。

来自主题: AI技术研报
7103 点击    2026-07-30 15:55
深度|10人团队登顶视觉推理榜,Chance AI 超过GPT、Gemini和人类专家

深度|10人团队登顶视觉推理榜,Chance AI 超过GPT、Gemini和人类专家

深度|10人团队登顶视觉推理榜,Chance AI 超过GPT、Gemini和人类专家

过去两年,多模态模型的竞争看起来像一场“造眼睛”的竞赛:更高的图像分辨率、更多的视觉 token、更大的模型,以及更昂贵的训练。行业似乎默认,只要第一次看得足够清楚,AI 就能从“看见”抵达“洞见”。

来自主题: AI资讯
10652 点击    2026-07-30 11:34
独家|牛津博士后林庆泓加入世界模型创企Video Rebirth,探索多模态智能体

独家|牛津博士后林庆泓加入世界模型创企Video Rebirth,探索多模态智能体

独家|牛津博士后林庆泓加入世界模型创企Video Rebirth,探索多模态智能体

Z Potentials 独家获悉,新加坡国立大学博士,牛津大学博士后研究员林庆泓(Kevin)近期以首席研究员(Principal Researcher)身份加入世界模型公司 Video Rebirth,负责多模态智能体与世界模型相关研究。

来自主题: AI资讯
10358 点击    2026-07-29 10:11