南科大教授余沛源创业做AI+材料:真正难的不是生成,而是验证
南科大教授余沛源创业做AI+材料:真正难的不是生成,而是验证人工智能可以在很短的时间内生成成千上万种候选材料,但真正进入实验室后,其中许多可能根本无法合成。
搜索
人工智能可以在很短的时间内生成成千上万种候选材料,但真正进入实验室后,其中许多可能根本无法合成。
面对大模型规模与硬件内存之间高达20倍的算力鸿沟,不重训的“1比特量化”如何把千亿参数的硅基大脑塞进微型设备?
视频世界模型跑久了,往往面临三个问题: 画面发灰发糊或者过曝过饱和、场景悄悄换了地方、显存先撑不住。
就在刚刚,SemiAnalysis的一个内部播客,曝出了不少猛料。据悉,Anthropic新模型Mythos 2已经训练完成,但惨遭雪藏。现在,Anthropic正用Mythos 2生成的数据,去全力冲刺Mythos 3!
机器人走出实验室后,训练数据不再只是 “多不多” 的问题:环境能否覆盖真实世界的尺度、遮挡、接触和运动,直接决定策略能否落地。Real2Sim 因此重新受到关注 —— 如果普通视频也能变成可交互的仿真场景,采集成本会比人工建模或专用设备低得多。
DeepSeek Harness ,正在成为全球网友的赛博乐高。我们在内部评测时相关标签显示的插件数量不到 300 个。开放之后,据不完全统计,目前 GitHub 上包含 dsh-plugin(DeepSeek Harness 插件)标签的仓库,已经来到了 6000 多个。
过去几年,大模型的发展主线很清晰,比如更大的模型、更多的数据,以及更多的计算。但当模型从回答问题的Chatbot走向能够调用工具、执行任务的Agent,发展主线也开始发生变化。模型不仅要知道,还要在环境中行动,从反馈中判断结果,并在长时间运行中不断调整策略。
测评 AI 这件事,如今越来越难做了。
你有多少工作,是需要「外包」出去做的,比如交给同事或者实习生?
日产7.5万首,播放却不到3%。