智谱唐杰:大模型只看参数的时代,结束了
智谱唐杰:大模型只看参数的时代,结束了Scaling Law还在,但今天的大模型,已经不能只靠“参数量”来理解Scaling了。
搜索
Scaling Law还在,但今天的大模型,已经不能只靠“参数量”来理解Scaling了。
完了,AI圈出「毒王」了!
逛WRC展区,我会带着三个问题看具身智能公司: 模型能不能处理复杂、长时序任务?操作系统是让AI当插件,还是真正嵌入了底层调度?本体有没有在成本和安全性上找到可规模化的平衡点?
今天的视频生成模型,已经越来越像一个会拍电影的导演。
上两天肝的视频上了热搜 + 热门,使用插件,针对 ds 模型可以提升不小的性能。
Qwen3.8-27B开始和顶级闭源模型正面叫板,过度思考是最大问题。
十多年前,Ilya Sutskever 说过这么一句话。 「模型就是想学习。」
DeepSeek V4 Pro,可能又又又更新了。今天下午,有用户在技术社区 Linux.do 发帖称,自己在DeepSeek Harness标准模式、V4 Pro Max思考档位下,发现模型的思维链突然变了。
8月13日凌晨,DeepSeek V4 Pro正式登场,给开源模型生态又添一把猛火。从Kimi K3到MiniMax H3,再到DeepSeek V4 flash、DeepSeek V4 Pro,在中国开源模型的猛攻之下,美国的AI公司这次是真的坐不住了。
半年累计融资近60亿元。