硅谷CEO: Grok Bot诞生,震撼程度堪比Claude Code时刻!
硅谷CEO: Grok Bot诞生,震撼程度堪比Claude Code时刻!最近,一个神级工具,震撼了硅谷。
搜索
最近,一个神级工具,震撼了硅谷。
外挂补不了模型智商,《苦涩的教训》再次上演。
昨夜,DeepSeek Harness迎来公测后的首次重要更新。DeepSeek Harness v0.1.0-rc.8版本上线,多模态能力成为这次更新的重头戏。此次更新共带来14项调整,覆盖多模态输入、子代理协作、终端体验、工具调用和开发者支持等多个方向,既补齐了Agent处理图片等多模态任务的能力,也进一步完善了子代理协作
ScienceDiscovery 是基于 Agent OS(JiuwenSwarm)开发的一款面向跨学科、全流程科研场景的一站式 AI 工作台,解决科研场景面临的工具碎片化、大模型科研幻觉两大痛点问题,打造 AI 辅助科研新范式,加速科学发现,广泛应用于各行各业。
科研的链条很长。文献读不完,方向想不清,实验一轮接一轮,论文改到深夜。过去两年,大模型已经能读论文、写代码、改文章,但它们大多以问答工具的形态散落在各个环节,替研究者节省的只是零碎时间。
Juno 2025年10月公开上线,上线前8个月,Juno 已经获得约15万次下载和1.5万个五星评价。Juno 官方现在明确把自己定义为一个面向慢性病患者的健康管理和陪伴工具。它不会提供诊断、治疗或替代专业医生的医疗建议。Juno 想解决的是另一个问题,比如你过去半年:
端到端策略模型在物理世界频频失灵,研究者转向 “大模型智能体 + 工具调用” 自救,试图在动态物理世界中持续学习。然而,这条在线学习路径在物理世界仍未真正走通。
《读佳》获知,字节正在内测一款漫剧创作产品,名字就叫“漫剧创作工具”,Slogan“让创作更纯粹”,搭载豆包多个大模型。
过去几年,大模型的发展主线很清晰,比如更大的模型、更多的数据,以及更多的计算。但当模型从回答问题的Chatbot走向能够调用工具、执行任务的Agent,发展主线也开始发生变化。模型不仅要知道,还要在环境中行动,从反馈中判断结果,并在长时间运行中不断调整策略。
只做AI代码审美国AI代码审查与管理工具商CodeRabbit宣布完成1.43亿美元(约合人民币10.3亿元)C轮融资。Crunchbase显示,截至发稿,CodeRabbit一共完成了6轮融资,累计融资额达2.31亿美元(约合人民币16.6亿元)。查赛道,也能跑出一个独角兽! CodeRabbit,估值已超15亿美元(约合人民币108亿元)。 美国AI代码审查与管理工具商Cod