都Agent时代了,我还是想分享给你这12个我最常用的Prompt。
都Agent时代了,我还是想分享给你这12个我最常用的Prompt。前两天发了个深度思考的Prompt,没想到大家反馈还挺好,然后也有人说,能不能把过去我写过以及一些最有用的Prompt整理个合集,再给大家分享一下。 然后我就翻了一下,才发现过去几年,确实已经零零散散
搜索
前两天发了个深度思考的Prompt,没想到大家反馈还挺好,然后也有人说,能不能把过去我写过以及一些最有用的Prompt整理个合集,再给大家分享一下。 然后我就翻了一下,才发现过去几年,确实已经零零散散
前几天,我在推特上刷到了一条很有意思的分享。
曾经我们对 AI 的期待还比较朴素,写邮件、翻译论文、聊天搭子……那时候,AI 像一个初出茅庐的实习生,你指哪它打哪,但也经常一本正经地胡说八道。
据DeepSeek官方API文档及GitHub仓库信息,一款名为Deep Code的第三方开源AI编程助手近日被收录进DeepSeek Agent工具。该工具面向DeepSeek-V4系列模型做了适配,支持深度思考、推理强度控制、Agent Skills以及MCP集成。截至发稿,Deep Code GitHub仓库显示,该工具收获超1500星、127 fork。
近年来,Chain-of-Thought(CoT)推理已经成为提升大语言模型和多模态大语言模型复杂问题求解能力的重要技术路径。
过去一年,整个 AI 行业都在告诉你:让模型多想一会儿,答案更好。但一批 GPT-5.5 重度用户刚刚用实战经验打了所有人的脸——thinking 开低、甚至不开,反而更稳更快更能打。
《读佳》获悉,搜狐于近日推出全场景多功能AI助手"小狐",该产品提供智能、高效、个性化的AI服务体验,覆盖生活、学习和工作场景。小狐拥有"快速响应"与"深度思考"双模式——前者追求速度,后者追求质量。
前面已经说了,传统自回归就像打字机一样,一次只能处理一个token,且必须按照从左到右的顺序。但扩散模型Mercury 2的工作方式更像一位编辑——最终,Mercury 2能将生成速度提升5倍以上,且速度曲线截然不同。
大模型的思维链越长,推理能力就越强?谷歌Say No——token数量和推理质量,真没啥正相关,因为token和token还不一样,有些纯凑数,深度思考token才真有用。新研究抛弃字数论,甩出衡量模型推理质量的全新标准DTR,专门揪模型是在真思考还是水字数。
当地时间 2 月 19 日,Google 曝光 Gemini 3.1 Pro 最新模型。在 ARC-AGI-2 这个公认的推理基准测试中,Gemini 3.1 Pro 拿到了 77.1% 的分数。什么概念?它的前辈 Gemini 3 Pro 只有 31.1%,就连专门用来「深度思考」的 Gemini 3 Deep Think 也只有 45.1%。