把思考折叠进序列:WeLM 617B MoE的隐式Scaling路径
把思考折叠进序列:WeLM 617B MoE的隐式Scaling路径新智元报道 大模型变强,过去靠两条路。 做大——Scaling Law出现后,参数从百亿推向千亿,算力支出一路飙升。 想久——o1带火思考模型,用更长的思维链、更多推理时间换结果。 问题是,除了Sca
搜索
新智元报道 大模型变强,过去靠两条路。 做大——Scaling Law出现后,参数从百亿推向千亿,算力支出一路飙升。 想久——o1带火思考模型,用更长的思维链、更多推理时间换结果。 问题是,除了Sca
随着Agent开始走进各大企业“干活”,AI时代的算力服务,正在变成竞争最激烈的领域。存储、光模块、高速互联等AI基础设施板块持续走强。前几年一度被边缘化的CPU,又重新成为了市场关注的焦点。CoreWeave、Nebius等一批NeoCloud公司快速崛起。微软、谷歌、亚马逊等云巨头都在疯狂加码AI投资。
就在最近,英伟达亲自下场,发布了一篇名为《AI Model Co-Design: Hardware-Friendly LLM Design》的技术博客。整篇文章洋洋洒洒,其实就想点醒行业一件事:别光顾着堆算力了,来看看你们是怎么把顶级显卡逼成“磨洋工”的吧。
2026年WAIC的展厅里,人潮涌动。大模型厂商在秀参数,算力厂商在秀集群规模。
这几天,全网被WAIC“霸屏”,从具身智能到国产算力,这场一年一度的AI盛典,同样吸引了科技圈所有目光。
全球能源竞争的正在从地面走向太空。马斯克曾提出一个极具冲击力的判断:“如果你把问题推到极限,人类究竟能调动多少 AI 算力?而真正远超地球一切能源规模的能量来源,其实就在太空。”
7月20日,一则消息震动全球AI圈:中国AI公司zAI(智谱AI)建成一座供电规模达1吉瓦(1GW)的AI数据中心,已开始部分运营。更核心的信息是——这座超大规模算力中心,完全未使用任何Nvidia芯片。
截至今年6月底,我国智能算力规模达2185EFLOPS(每秒执行2185百亿亿次浮点运算)。全国算力设施整体上架率达71.4%,建成万卡以上智算设施52个。传输通道持续拓宽,近两年围绕国家算力枢纽节点建设超70条算力大通道,相关算力枢纽节点间网络性能提升10%。
就在今年的WAIC上,无问芯穹一口气亮出了「前店后厂一中心」,一整套完整的Agentic Infra战略布局:算力集散中心(一中心):Agentic Infra自主式基础设施平台;Token工厂(后厂):Agentic MaaS大模型服务平台;
不久前,Kimi 官方宣布,将暂停新会员订阅。月之暗面表示,公司正在增加算力,并将在容量允许后分批重新开放订阅。不过,官方目前尚未公布具体扩容规模,也没有说明新增订阅何时恢复。