AI不缺算力,缺的是一块“懂模型”的硬盘
AI不缺算力,缺的是一块“懂模型”的硬盘寅谱试图用一种“以存换算”的思路破题:不是让硬盘SSD替代GPU计算,而是用更低成本的SSD承接温冷(指访问频率极低和中等)的AI大模型数据、复用已经完成的中间结果,减少显存及内存压力、GPU等待和重复Prefill(预填充)。
搜索
寅谱试图用一种“以存换算”的思路破题:不是让硬盘SSD替代GPU计算,而是用更低成本的SSD承接温冷(指访问频率极低和中等)的AI大模型数据、复用已经完成的中间结果,减少显存及内存压力、GPU等待和重复Prefill(预填充)。
业务覆盖企业私有化算力部署与自营Token工厂。 作者 | 杨京丽 编辑 | 李水青 智东西8月27日报道,昨日,北京AI基础设施创企博伦智汇宣布完成千万级天使轮融资。本轮融资由专注AI及AI Inf
刚刚,OpenAI Codex负责人Tibo宣布,明天开始将会恢复ChatGPT Work和Codex平台上Plus用户的5小时用量限制。据Tibo所说,这一做法早就在计划之中,目的主要是减轻算力负荷,从而在周使用额度上提供更慷慨的计划。
算力上限,是物理 AI 落地过程中需要面对的现实约束之一。
最近,一支法国科研团队干了一件听起来像赛博朋克小说开场的事:把来自死后供体的成人脑切片泡在培养皿里,接上一只机械手和一个麦克风。相关论文的标题是:《人类大脑离体培养物的无监督感觉-运动关联学习,使机器人实现动作模仿》。
当所有人都在担心AI抢走饭碗的时候,美国工会给出了一个简单粗暴的答案:既然机器替人干活,那就让机器缴税。华盛顿消息,美国劳工联合会-产业工会联合会、国际卡车司机兄弟会等劳工组织联合提出立法建议,拟对高算力消耗企业征收0.5%的“AI自动化特别税”。
当算力真正成为稀缺资源时,人们会发现,在任何一个机构里,往往只有几十名研究者贡献了大约80%的成果。真正昂贵的不是研究者本人,而是与他配套的算力。因此,如果拥有一定的Token预算,你要把它分配给谁,为什么。
真是没想象到,卖了大半辈子芯片的老黄,最近开始当起了 AI 圈的“红娘”。 一头是手握GPU的AI公司,一头是手握电力和机柜的数据中心。 两边都是老黄的客户。 据CNBC报道说,老黄最近正在北欧牵线,
Callosum是一家开发软件将特定人工智能任务与不同模型和芯片进行匹配的初创公司,已从包括英国公共AI基金等多家投资方处筹集了1亿美元的融资。
GLM 5.3发布后不到一小时,智谱一名销售的电话和微信都爆了:十几个来询问API上线时间的,以及吸取了Kimi K3教训,想提前锁定智谱推理算力的客户也不少。这种状况一直持续了整个周末。