匿名打榜的都是二流模型
匿名打榜的都是二流模型不难看出,写这篇的原因主要是被牛来大模型伤到了。
搜索
不难看出,写这篇的原因主要是被牛来大模型伤到了。
据 The Information 报道,本月早些时候,这笔备受行业瞩目的天价收购案正式尘埃落定。随后,马斯克通过视频连线,首次直面了聚集在 Cursor 旧金山总部及各办公区的 1000 多名新员工。在这场内部会议上,马斯克非常坦诚地剖析了当下的竞争格局。
“你以为你买的是 DeepSeek Flash,实际上可能是个 1.5 bit 的 DeepSeek,或者里面掺了 Opus 用于训练。”这是 Pi 核心贡献者 Armin Ronacher 的一个比喻。他形容现在的 token 市场像一种成分不明的商品——量化程度、实际版本、是否掺了别的东西、计费方式,全是黑洞。
今天,飞象老师正式发布3.0版本。这次升级最值得关注的变化,是新增了“教育应用生成”能力。用户只需要在对话框里说清楚自己的需求和想法,几分钟后,就可以得到一个能够直接访问、调用AI、保存数据,并持续修改迭代的教育应用。整个过程中,不需要写代码,也不需要理解数据库、服务器和部署。
刚刚,OpenAI Codex负责人Tibo宣布,明天开始将会恢复ChatGPT Work和Codex平台上Plus用户的5小时用量限制。据Tibo所说,这一做法早就在计划之中,目的主要是减轻算力负荷,从而在周使用额度上提供更慷慨的计划。
就在刚刚,英伟达史上首次公布了下一代旗舰级机柜 Vera Rubin NVL72 的首次片上实测数据。而且,这次实测直接拉来了DeepSeek-V4-Pro,跑最真实的「智能体编码」任务!结果令人吃惊:对比当前的主力机皇GB300 NVL72,Vera Rubin的每兆瓦吞吐量最高飙升了30倍、Token成本最高暴降了35倍!
从社区走向的一整套创作产品。
最近两天,X 上网友 Max For AI@MaxForAI 的一篇帖子引发了网友热议:「太疯狂了 —— 现在你甚至可以直播围观一个 535B 大模型是如何被训练出来的。」
大模型开始吞噬越来越多的东西,创业公司究竟还能做什么?
模型的发布流程,早已在密集迭代中演变为精准的工业流水线:技术报告开路,Benchmark榜单刷屏,紧接着开放API,最后以开源权重收尾。