快一点!再快一点!快到世界能实时生成|和生数科技张金涛聊:Vidu S1、推理加速、实时交互模型
快一点!再快一点!快到世界能实时生成|和生数科技张金涛聊:Vidu S1、推理加速、实时交互模型金涛今年 26 岁,还是清华在读博士。真正把他带进「推理加速」的,是一个很朴素的判断——当大家都默认 FlashAttention 已经把 Attention 算子做到极致时,他却发现:显卡上明明还有更快的计算单元没被用起来 ——「这么明显的收益,为什么没人做?」
搜索
金涛今年 26 岁,还是清华在读博士。真正把他带进「推理加速」的,是一个很朴素的判断——当大家都默认 FlashAttention 已经把 Attention 算子做到极致时,他却发现:显卡上明明还有更快的计算单元没被用起来 ——「这么明显的收益,为什么没人做?」
据The Information独家报道,Taylor目前所领导的AI客户支持初创公司Sierra正在收购Thumaty创办的三人初创公司Takeoff,后者开发的Agent能够长时间持续处理各类任务。Sierra高管希望,随着公司试图从AI驱动的客户支持Agent业务拓展到销售面向其他任务的Agent,Thumaty的专业经验将大有助益。
如果要让机械臂把咖啡机旁的杯子移到桌上,需要经历哪几个步骤?
2026 年 7 月 20 至 24 日,硬核少年技术节 5.0 在杭州、北京共同举办。
迁移学习里的“源数据”,未必非得是图像、文本或音频。
一夜之间,Tokenmaxxing成为硅谷热议话题!
交互式视频世界模型正在从「一次性生成短片」走向「像游戏一样边操作边生成」。但长轨迹交互会迅速放大上下文、显存和多步去噪开销。Light Interaction不改模型参数、不重新训练,只在推理阶段把相机轨迹变成调度信号,动态选择历史上下文、在回访状态复用去噪输出,并用面向自回归生成的3D稀疏注意力降低计算。
袁博地的答案是否定的。从清华大学接触计算机视觉,到 UC Berkeley 攻读 AI 博士,再到 Google X 负责机器人的视觉系统,袁博地过去十多年的研究几乎始终围绕 Pixel 展开:从图像识别,到 GAN、Diffusion,再到图像和视频生成,技术范式不断变化,研究对象却始终指向同一件事——如何让机器理解和生成视觉世界。
Kimi K3 发布不到一周,就已成为美国政府的「眼中钉」。据 Axios 报道,特朗普政府内部正在重新讨论,是否应加强对中国开放模型的管控。此前,美国商务部曾考虑将多家中国实验室列入「实体清单」,美国国家安全局和白宫国家网络主任办公室也讨论过发布安全警告,劝阻美国企业使用中国模型。
腾讯的设计Agent平台Miora,今天终于全面开放了。之前一直需要邀请码,还得预约排队,而今天,终于正式全量上线。别的不说,你永远可以相信腾讯的产品设计和审美。网址在此:miora.design