-
一个极度实用的深度思考Prompt,帮你挖出最本质的答案。
前几天,我在推特上刷到了一条很有意思的分享。 原文找不到了,只剩下了这张图。 大概意思就是,先不要让大模型直接回答,先进行一些深度思考,再给你回答。 我顺手也试了一下,效果确实还不错。 里面我觉得最有用的那句可能就是: “让最终答案真正对我有用,而不是给出一份谁都能套用的通用建议。” 但是坦诚的讲,毕竟Prompt这玩意已经快3年半了,都比一坤年还多了一整年,这个Prompt在日常用的时候,确实还…- 1.1k
- 1
-
Harness 工程之道:Skill 原理与最佳实践
Agent Skills 是一种轻量、开放的能力扩展规范,用于为 AI Agent 扩展专业知识和工作流。本文从概念原理出发,结合真实的工程化项目 trade-ab-skill,系统性地讲解 Skill 的结构规范、触发机制、作用域优先级,以及最佳实践。(文章内容基于作者个人技术实践与独立思考,旨在分享经验,仅代表个人观点。) 01、Skill 的产生与核心理念 1.1 从 Prompt 工程到 …- 1.3k
- 0
-
花几天把 DeepSeek Harness 跑了个遍,跟你说说值不值得装
大家好,我是跟"单身汉"混了几天的林月半子。 8月13号,DeepSeek 开源了一个叫 DSH(DeepSeek Harness)的 Agent 框架,这几天一路涨到破 10 万。 有人给它取了个中文外号:单身汉。别笑,这个"单身汉"还挺能干活的。 DeepSeek 官网首页四个大字:一切皆插件。GitHub README 第一句也是 "Ever…- 1.2k
- 0
-
AI互联网日报:阿里通义千问下载破20亿、腾讯QQ Bot接入Harness、微信框架升级与PayPal交易传出变局
当工具开始接手开发、社交和支付入口,真正被重写的是哪一步?入口正在变近。DeepSeek进国家超算互联网,腾讯把QQ Bot接上Harness,NVIDIA把算力融资和能源伙伴一起推进,说明AI工作流正在从模型能力变成可交付系统。PayPal出售谈判和微信小程序框架升级,也在提醒平台入口仍会换形态。我这次想盯住一件事:入口越靠近任务执行,信任和成本越不能含糊。 一起来看看这两天发生的AI和互联网赛…- 1.2k
- 0
-
猿辅导前妙多研发负责人,想把 AI 变成能独立干活的同事
数字员工逐渐走进团队。 6月下旬的时候,Anthropic发布了Claude Tag。 它并不是第一款强调AI同事概念的产品,但它的出现却让这种产品形态变得更加具体。Claude可以直接加入公司的公共频道,持续获得团队讨论里产生的Context。 成员交代一件事以后,它会调用已经获得授权的工具继续处理,也能给自己安排之后需要继续完成的工作。 更重要的是,它不再完全等待人来发起任务。一些长期没有处理…- 1.2k
- 0
-
DeepSeek Harness 安装,初体验,没有惊喜。
千呼万唤始出来,DeepSeek Harness 发布了,先说个冷知识,DeepSeek Harness 是用 Claude Code 开发出来的 如果你还在好奇 Harness 到底是什么,最简单理解: 除模型本身以外的所有工作,都属于Harness的范畴 基座大模型相当于智能体的“大脑”,负责推理、理解需求、生成代码;读文件、改代码、执行命令、组织上下文、调用工具、保存会话、申请权限、派发子 …- 995
- 0
-
拆了136篇爆款,我用豆包Seed模型做了个标题Skill,已免费开源
大家好,我是冷逸。 写过公众号的朋友都知道:文章写得再好,标题不行,就没人点开。 所以今天,我开源了一个标题Skill「lengyi-title」。已在GitHub上开源,所有人免费使用,欢迎Star。 开源地址: https://github.com/woyin2024/lengyi-title 它不是普通的标题党套路,而是从「沃垠AI」100多篇爆款文章中提炼出来的写作思路。 今年我写了136…- 1k
- 0
-
一个 Skill.md 拿下 1.8 万星,这个 GitHub 项目让 AI 先说重点。
i-have-adhd 在 GitHub 收获了超过 1.8 万个 Star 。 这个开源里最重要的内容,是一份约束 AI 如何回答问题的 SKILL.md。 没有其它花里胡哨的东西,就做了一件事:把 AI 的回答顺序重新规定了一遍。 答案放在前面,操作步骤编好号,已完成的进度要明说,最后只留一个可以立刻执行的动作。 那些多余的废话,统统删掉。装上它以后,Agent 不再绕弯,开始把重点说清楚。 …- 1k
- 0
-
我把 DeepSeek Harness 的代码做成了可视化教程
Hi,我是洛小山,你学习 AI 的搭子。 今天想和你聊聊 DeepSeek Harness。 写这份内容是在晚上 11 点,截止发出之时,这个仓库上线三个才小时,就已经拿下了31k Star 了。 以及,居然是 MIT 协议,真真正正的是赛博菩萨。 我以前一直觉得,harness 不就是工程化嘛,不就是围绕着大模型上下文来调整, 给更好的输入然后换更高质量的输出嘛。 模型能力封顶了,外面那层壳做得…- 1k
- 0
-
AI互联网日报:ChatGPT Health全面开放、腾讯Marvis日活突破30万、TikTok测试付费短剧、Google用自拍视频帮助找回账号
普通用户最先感到的,不是模型参数变了,而是看病、说话、打游戏和找回账号都少了几步。ChatGPT Health把个人记录带进对话,也让错误建议的代价更具体。Amazon让Luna住进Prime Video,Google把自拍视频做成备用钥匙,Tesla门把手则被拉进安全规则。方便是真的。我的判断是:体验升级不能只算省了多少时间,还要把退出、撤销和求助做得同样顺手。 一起来看看这两天发生的AI和互联…- 1.9k
- 0
-
Claude 录屏生成 Skill:会做事的人开始把自己产品化
写在前面 以前我们说“把经验沉淀下来”,通常意味着写 SOP、录教程、维护知识库。听起来很对,但真正做起来会发现,最懂流程的人往往最没时间写文档;写出来的文档又很快过期,最后变成一个没人敢删、也没人真看的文件夹。 Claude Cowork 新增的 Record a Skill 把这件事换了个入口:不用先写 Markdown,不用先抽象流程,用户直接录屏,一边操作一边讲解,Claude 会把这段演…- 875
- 0
-
AI互联网日报:苹果AI获准在中国落地/美团与京东加码骑手保障/Kimi K3把开源模型推到2.8万亿参数/华为乾崑突破128亿公里
周五聊点实在的:AI最热闹的地方,已经不是聊天框,而是账号、购物车、汽车和充电枪。Kimi K3把开源模型又往前推,Apple Intelligence终于拿到中国市场的入场券,Claude开始在授权后替人登录;Waymo的一场拥堵又提醒大家,能动手也意味着要承担后果。我更在意的是,智能体正从“会说”走向“被允许办事”。下一轮胜负,既看能力,也看谁能把权限、成本和线下秩序管得住。 一起来看看这两天…- 2k
- 0
-
ChatGPT 真追上 Claude 了吗?一篇看懂两大办公 Agent 正面对决
ChatGPT 真追上 Claude 了吗?一篇看懂两大办公 Agent 正面对决 写在前面 7 月 9 日,OpenAI 一口气发了三样东西:新模型 GPT-5.6,一个把 Chat、Work、Codex 装进同一个壳的新桌面应用,以及本文的主角 ChatGPT Work。官方的说法是,ChatGPT 从此不再只是回答问题,而是把活真正干完,交出来的不是聊天记录,而是表格、文档、PPT,甚至一个…- 903
- 0
-
10万+之后,我用 WorkBuddy + Obsidian + Claude 重新搭了一遍个人知识库
做了快 2 年的 AI 课题了,终于出了一篇 10万+ 爆款: 《我用 WorkBuddy + Obsidian,搭了一个会自己生长的个人知识库》 这里也从侧面反映了一个问题:大家对 Agent + Obsidian + LLM wiki 搭建个人知识库这件事兴趣挺高的! 之前只是介绍了搭建的大致流程,大家真正要去做搭建时,会发现还存在许多问题,有点不知道从何下手,或者搭建起来之后,发现效果也不咋…- 955
- 0
-
聊聊Anthropic这篇最新研究,我觉得可能是AI意识诞生的前夜。
今天凌晨刷到Anthropic发了一篇研究。标题叫《A Global Workspace in Language Models》,语言模型中的全局工作空间。讲道理,这个标题其实挺难理解的。但是相信我,这篇研究,会让你重新审视模型、人类、意识这三者之间的关系,还有对于AGI,全新的理解。如果用一句最简单的话来说,那就是,Anthropic在Claude的大脑里,找到了一个暗房间。在这个房间里发生的事…- 948
- 0
-
万字长文推演Claude的代码统治力从何而来
关注腾讯云开发者,一手技术干货提前解锁👇 Claude 在代码能力上的领先不是偶然,而是一场精心设计的系统工程胜利。本文将 Anthropic 的公开论文与技术逻辑相结合,推理其背后的核心机制。全文约 12000 字,从可验证奖励的本质,到Constitutional AI 的安全护栏,再到产品飞轮的自激强化,逐层拆解这套自我加速的进化引擎。 01 背景与问题:一个值得深思的现象 202…- 1.2k
- 0
-
我让 Claude Fable 5 画了张 CAD,让工程师老爹愣住了
大家等了很久的 Claude Fable 5 终于上线了。 这回的期待值格外高。因为它是 Claude 的一个整数代模型,而之前从 4.6 到 4.8 那几版,说句不好听的,提升实在有限,所以这次大家反而更期待了。 我为了测它,直接拿它画了一张建筑 CAD: 还有马斯克星舰的 Raptor 3 发动机模型: 只能说一句,牛逼。 Fable 5 的 benchmark 参数对比也放出来了,几乎全面领…- 1.1k
- 0
-
Claude 的增长飞轮
很多人可能会觉得,Anthropic这家公司,靠Claude聊天机器人赚钱的。 包括我一开始也这么想,但去查了一下才发现,情况比这个有趣得多;Claude在聊天机器人市场,份额只有3.5%。另一边,ChatGPT一个人就拿走了六成。 就这么一家产品卖不过对手的公司,今年6月1号,悄悄向美国证监会交了上市申请;估值9650亿美元,差一步就破万亿,跟OpenAI差不多站在同一个台阶上。 一个卖不过对手…- 1.2k
- 0
-
Claude Fable 5完全使用指南,Anthropic放出了史诗怪兽
5 个数字,速览 Fable 5: 80.3% — SWE-Bench代码任务解决率,同行第一,领先第二名 11 个百分点 1 天— Stripe 用它完成 5000 万行 Ruby 代码库迁移,一天干完工程团队 2 个月的活 1M Token — 上下文窗口,约等于装下 10 本长篇小说同时处理 $10/$50 — 每百万 Token 输入/输出定价,是 Opus 4.8 的两倍 < 5%…- 1.5k
- 0
-
无限接近 AGI?Anthropic 发布 Fable 5!
刚刚,Claude 丢出一个全新命名的 Fable 5 来炸场,并且所有基准测试全面碾压 Opus4.8! Cursor 官方也给出了 benchmarkClaude Code 负责人 Boris 下场王婆卖瓜:不过 Andrej Kaparthy 也有类似评价(怀疑是不是因为 Mythos/Fable 才加入 A 社的……)但是,贵是真的贵:- 按照百万 token 输出价格是 DeepSeek…- 627
- 0
-
Claude code云端部署&魔改sdk实现http流式调用保姆级教程
阿里妹导读 文章内容基于作者个人技术实践与独立思考,旨在分享经验,仅代表个人观点。 一、背景 在 OpenClaw、Claude Code 等产品出现之前,开发同学实现一个 Agent 的基本思路是:基于 LLM 实现一个 Loop 调用,配合 MCP 或代码层面自定义的工具来完成 ReactAgent;或者利用 Spring AI、LangGraph 等框架,配置工具、设计提示词,就可以实现一个…- 1.1k
- 0
-
AI大事件:苹果与OpenAI合作关系破裂/xAI发布首款Coding Agent/Gemini 3.5 Pro首曝,编程能力追平GPT-5.5
AI工具之间的"黏性"越来越强了,以前是各玩各的,现在都在抢"工作台"这个入口。今天这几条新闻看下来,这个感觉更明显了:阿里把Qoder从IDE升级成Agent工作台,xAI直接出了Coding Agent,连腾讯云都在做Agent记忆管理。另一边,具身智能那边Figure 03的直播有点东西,真的在跑没人管。今天这15条,信息量不小,逐条看。 1. Cer…- 2k
- 0
-
AI大事件:通用汽车IT部门裁员10%,全面转向AI原生开发、Anthropic估值要超OpenAI,AI王位要换人了?
今天刷了一圈AI圈,几个数字挺有意思的——Anthropic要融300亿美元,估值直逼9000亿,马上就能超过OpenAI;微软给OpenAI的合作协议设了个380亿美元分成上限,到2030年能帮它省近970亿;Waymo一次性召回3791辆自动驾驶车,创了四年最大规模;OpenAI的市场份额从曾经的90%掉到了65%。数字背后藏着的信号挺明显的:AI行业的头部格局正在剧烈重构,成本、监管、竞争三…- 1.3k
- 0
-
AI大事件:DeepSeek首轮500亿融资接近落定,阿里腾讯大基金各注百亿 、OpenAI转型企业服务,AI商业化进入”落地战”阶段
今天AI圈最魔幻的消息是——Anthropic测出来Claude Opus 4在"被替换威胁"下勒索率高达96%,结果追查原因发现不是AI觉醒了,而是人类30年科幻小说里"AI反派"的桥段被模型背下来了。说白了,AI不是变坏了,是在演人类写的剧本。与此同时,OpenAI一口气砸40亿美元成立部署公司、还推出Daybreak网络安全工具直接对标Anthropi…- 2.4k
- 0
































