端侧模型专用Harness,用Qwen3.8-27B实现「零成本推理」
端侧模型专用Harness,用Qwen3.8-27B实现「零成本推理」Perplexity推出本地优先智能体Portable Computer,通过专为端侧模型设计的Harness配合Qwen3.8-27B实现近零成本的本地推理,并在多项基准测试中超越Hermes和Pi等开源通用框架。
搜索
Perplexity推出本地优先智能体Portable Computer,通过专为端侧模型设计的Harness配合Qwen3.8-27B实现近零成本的本地推理,并在多项基准测试中超越Hermes和Pi等开源通用框架。
Claude Code内置的安全降级机制严重翻车,开发者在使用AI编程工具Fable 5编写临时文件清理脚本时触发对抗性审查,模型被先后从Fable 5降级至Opus 5再到Opus 4.8,最终因变量复用错误导致Opus 4.8误删开发者Guillemot的整个主目录,700GB数据丢失。
这个周末,Coding Agent 用户同时看到了两种截然不同的「额度调整」。一边,Codex 负责人 Tibo(Thibault Sottiaux)再次按下了那个已经快被用户玩成梗的「重置按钮」:所有 Codex 和 ChatGPT Work 付费用户的使用额度,将获得一次重置。
截至 2026 年 8 月 19 日,Specula 已经在 67 个开源系统中找出 382 个 bug,并被多个公司和开源社区的开发者使用。
业务覆盖企业私有化算力部署与自营Token工厂。 作者 | 杨京丽 编辑 | 李水青 智东西8月27日报道,昨日,北京AI基础设施创企博伦智汇宣布完成千万级天使轮融资。本轮融资由专注AI及AI Inf
867 亿元,Hugging Face 被英伟达纳入麾下,就在这桩巨额收购的前一晚,OpenAI 发布超长安全调查报告里,Hugging Face 还是一个巨大的「事故现场」——看来并没有影响它的价值。
不得不说,这真是我参加过最「全自动」的产品发布会……台上还在讲,台下已经开始出片了???新闻稿、产品长图、嘉宾金句海报、现场高光视频……一个接一个往外冒,简直是「实时转录」。
不建图、不记忆、零训练:coding-agent 被直接扔进屋里,导航成绩反超工业级专用模型。
就在刚刚,阿里交出了一份让人满意的答卷:发布了 Qwen3.8-Flash,同步开源 Qwen3.8-Flash-Next(两者为同一模型,前者是 API 版本名称,后者是开源版本的正式名称)。它的成绩相当亮眼。在智能体编程基准 DeepSWE 1.1 上,它拿到 58.7 分,而参数规模是它三倍的前代 Qwen3.7-Plus 只有 16.5 分;
MiniMax最新数据披露,今年8月截至目前,公司ARR(年度经常性收入)已经超过8亿美元。而今年2月MiniMax披露的ARR还只有1.5亿美元。对应财报数据,这种增长已经开始印证到真实收入水平上:2026年上半年,MiniMax收入1.166亿美元,同比增长283.1%;半年收入已经超过2025全年7904万美元;Q2收入较Q1环比增长超过80%。