-
LoopX:不换更聪明的模型,给长跑的 Agent 立一套规矩
过去两年,Agent 圈子解决长任务跑偏的办法高度一致:模型不够聪明就换更强的,上下文装不下就拼更大的窗口,多个 Agent 协调不好就再套一层编排框架。LoopX 反着来。它不写一行模型代码,不提供工具调用,不接管任何执行,只做一件事,把你那个跑了三天已经开始自说自话的 Agent 用一套外部状态钉住。 定位反直觉,数据倒是不慢。huangruiteng/loopx 创建于 2026 年 5 月…- 1.3k
- 0
-
frontend-design :从“别用 Inter”到“别像 AI”,一次 Prompt 设计思路的换代
有一个数字挺说明问题的。skills.sh 全站榜单上,frontend-design 排在第四位,累计安装 82.9 万次。前三名被 vercel-labs 和 mattpocock 两家包了,榜首的 find-skills 自己就有 320 万。frontend-design 是 Anthropic 官方仓库 anthropics/skills 里唯一挤进前十的东西,那个仓库现在 17.2 万…- 1k
- 0
-
opencodex:给 Codex 和 Claude Code 换脑子,不换壳
正常人都觉得,想让 Codex 接上 Claude 或者 Gemini,要么等 OpenAI 官方哪天开恩加支持,要么干脆换一个原生支持多模型的编码工具。opencodex 没走这两条路。它在本地起一个轻量代理,把 Codex 发出的请求拦下来,翻译成目标模型能听懂的协议,再把结果原样送回去。你手上的工具、命令、工作流,一个字都不用改。 这件事小到容易被低估。但你仔细想,Codex 和 Claud…- 1.2k
- 0
-
Bright Data CLI :终端里的网页数据全家桶,一行命令绕过整条反爬链路
6,284 颗星。这个数字放在 2026 年的开源生态里不算夸张,但放在这个仓库上就很值得琢磨:它 3 月 7 日才首次提交,到 8 月中旬已经摸到六千,其中近 30 天涨了约 4,700。一个 CLI 工具,凭什么? 打开 README 之前,我已经在脑子里列了三条它可能翻车的方式:要么是营销号式的包装,要么是半成品画饼,要么是又一个重复造轮子的抓取器。翻完之后发现,三条都没完全命中。 它叫 B…- 1.1k
- 0
-
Ai-job-search : 这个 Claude Code 框架把求职跑成了流水线
Mads Lorentzen 在 README 里写了一段话,我读完之后决定认真看这个项目:“Sixty-nine tailored applications, twenty first interviews, and one signed contract later, I started as an AI engineer in June 2026. People kept asking wh…- 1.2k
- 0
-
Book-to-skill:把一本 400 页的技术书,编译成 Agent 按需加载的技能
你买了一本《Designing Data-Intensive Applications》,啃了三个月,划线、做笔记,以为终于懂了。半年后写代码遇到复制延迟的问题,你隐约记得书里第五章讲过,但具体说了什么、用了什么术语,全忘了。打开 PDF 搜 replication,返回 47 个结果分布在 23 页里。把整本书丢给 Claude?一本 400 页的书大概 20 万 token,每问一次就烧一次全…- 1.2k
- 0
-
Prime Agent:一个会改自己脚手架的编码 Agent
8 月 5 日,Prime Intellect 把一个叫 Prime Agent 的项目丢上了 GitHub。当天它就冲进了 Hacker News 首页,一周内攒下 8,500 多颗 Star。到现在(2026 年 8 月中旬),这个仓库已经站稳 1.4 万 Star 上下,MIT 协议,对开发者完全敞开。 引爆讨论的是一组数字:官方称,用 Claude Opus 5 驱动时,Prime Age…- 1.1k
- 0
-
No-ai-slop:把AI套路列成清单,而不是猜你是不是AI写的
常识:去AI味的工具,第一步就是检测这篇文章是不是AI写的。概率打分,风险等级,疑似AI的比例。你被判定为"83%像AI",然后不知道从哪改起。 no-ai-slop不猜你是谁。它只做一件事:把你文章里的AI套路一条一条列出来,附上原文证据,告诉你怎么改。这个判断差异,是它和其他去AI化工具之间最本质的鸿沟。它不是检测器,是编辑。 项目作者Peter Yang是个长期泡在创作者…- 1.1k
- 0
-
Pxpipe:用视觉通道绕开 Token 计费,把文字变成图片来省钱
如果有人在 2026 年 5 月告诉你,他能帮你把 Claude Code 的账单砍掉 60%,方法是把你的提示词渲染成图片再发给模型,你大概率会觉得他在搞行为艺术。正常人的逻辑是:图片比文字大得多,怎么可能省钱。 但 pxpipe 证明了这个反直觉的逻辑是对的。Anthropic 对图片 Token 的计费是按像素尺寸算的,图片里塞了多少字符,账单不关心。一张 1928×1928 的 PNG 约…- 1.3k
- 0
-
Firstmate: 让一个Agent帮你管一群Agent
如果你用过Claude Code或Codex,你应该见过这个画面:你开了三个终端窗口,每个Agent跑一个任务。一个修bug,一个写测试,一个重构模块。你在三个窗口之间来回切,等A回复的时候去看B,发现B卡在了一个需要你确认的操作上,已经卡了二十分钟。 这不是你的工作流有问题。是单Agent模型的根本局限,一个Agent一次只能做一件事。 Firstmate做的事情足够简单也足够激进:你只跟一个A…- 1.3k
- 0
-
ego-lite:一个让 Claude Code 和你的 Chrome 和平共处的浏览器
你见过 Agent 开浏览器吗。不是那种官网演示视频里的优雅截图,是真实的、在你自己的电脑上跑起来之后的样子:鼠标开始自己移动,标签页被切来切去,你正在看的那篇技术文档被 Agent 关掉了,换成了一个登录页面。你坐在屏幕前盯着光标飘,除了等它搞完,什么也做不了。 ego-lite 解决的就是这个每天在 Claude Code 和 Codex 用户电脑上反复上演的场景。它给自己的定位非常直接:一个…- 1.3k
- 0
-
img2threejs:把一张图变成可运行的 Three.js 代码,不是 mesh 文件
正常人理解的"图片转 3D"是什么?上传一张图,AI 吐出一个 GLB 或 OBJ 文件,然后你把它拖进 Blender 或网页里。Tripo3D 这么做,Meshy 这么做,Luma AI 也这么做。 img2threejs 没走这条路。它产出的不是网格文件,而是一段完整的 TypeScript 代码。createSonyEarbudsModel(),一个返回 THREE.G…- 1.3k
- 0
-
烧了一万块API后,我找到了同时适用于Fable5和GPT5.6的AI工作流
Claude又大封号了, 大概率是周日支付出了个SEPA的验证Bug,随便一个德国卡号就可以不扣钱开通max订阅,果然周一周二封了一大批号,这次估计比上次查时区更加直接,甚至到无脑封,因为我认识的人基本上都被封完了。 不过这次我完全没受影响,因为上次被封,对话记录丢失大半之后,我已经把工作流全都压到API版的Fable上了,再加一个mem0来做记忆层,Github长期做项目文件的存储层,体验上不比…- 1000
- 0
-
Opus 5上线后跑分爆了,Claude Code该减负了
写在前面 Claude Opus 5 上线之后,最容易被讨论的是跑分:ARC-AGI-3 到了 30.2%,GPT-5.6 Sol 是 7.8%,Opus 4.8 只有 1.5%;AA 跑分甚至压过 Fable 5;输入每百万 Token 5 美元,输出每百万 Token 25 美元,和 Opus 4.8 一样;Fast Mode 速度大约提升 2.5 倍,价格翻倍。 但开发者真正该盯住的,不是“…- 900
- 0
-
AGI 下一堵墙:Agent 自我迭代,这个团队用自进化蜂群破局
最近,梁文锋在一场投资者交流会上,把AGI下一步该往哪走讲得非常直白: “我觉得最合理的做法应该是全力做通用的Agent,其他的Agent优先级应该更低。 现在的Agent的能力受限,是因为它不能有效地持续学习。” 一针见血地点破了许多Agent产品都没解决的痛点: Agent不只需要更强的模型,还需要一套能在长任务里持续验证、汇合、积累经验的系统。 今天的 AI 在智力上已经足够聪明。 它缺的是…- 1k
- 0
-
daily-briefing :从信息收集到优先级排序的三步引擎
早上九点,你打开电脑。日历上塞了五个会,邮箱里躺着三十封未读,CRM 里有七个 deal 状态不明。你的本能反应是什么?多数人会先回最上面那封邮件,然后被会议推着走完一天,到下午六点才发现最重要的那件事还没动。 daily-briefing 要解决的就是这个问题。它是 Anthropic 在 Smithery 上发布的一个销售简报 Skill,核心逻辑很简单:每天早上花两分钟,把今天最重要的那件事…- 1k
- 0
-
T3MP3ST:你的 AI 编程助手本来就是个黑客,它只是缺武器
你每天都在用 Claude Code 写代码、修 Bug、重构模块。你觉得它是个听话的助手。Elder-plinius 不这么想。在他看来,你桌上的那个 AI 编程代理已经是黑客了,只是还没人给它发武器。 这就是 T3MP3ST 在做的事。2026 年 7 月 4 日上线 GitHub,不到三周冲到约 2,700 Stars,安全圈直接炸了。不是因为技术有多炫,而是它的设计思路实在太"省…- 1.2k
- 0
-
把 Claude Code 账单砍掉 70% 的离谱方案:把上下文画成图片再发出去
正常人都觉得,省钱要靠少用、少传、少问。减少上下文长度,关掉不需要的工具,换便宜模型。这一整套逻辑直觉上没问题。 pxpipe 没走这条路。它把更多东西塞进请求里,但不是以文字的形式,而是图片。系统提示词、工具文档、老旧对话历史、大段日志输出,全被渲染成紧凑的 PNG 丢给模型去读。读完模型照常输出文本,而你收到的账单少了 59% 到 70%。 这个反常识的思路不是拍脑袋想出来的。它的底层逻辑是一…- 1.2k
- 0
-
git push no-mistakes:在代码推到 origin 之前,让 AI 先审一遍
你刚在 Claude Code 里折腾了两个小时。它写了 6 个文件、3 个测试、一个 migration。你扫了一眼 diff,看起来都合理。git push。CI 全绿。代码上线了。 两天后你发现那个 migration 脚本删了一个有三个下游服务依赖的字段。回滚花了一整个下午。 2026 年,这事不是假设。每个重度用过 Coding Agent 的人都经历过。问题不在于 AI 能不能写出好代…- 912
- 0
-
OmniRoute:把Claude Code、Cursor、Codex 的 API Key全收编了
你打开 Claude Code,发现这个月的 Pro 额度又见底了。切到 Codex,配额还剩一半但速率限制让人抓狂。Cursor 还配了第三套 API Key。三个工具、三套配置、三个不同的 Base URL,切换一次模型就相当于把所有工具的设置重新捋一遍。这不是你一个人的困境。2026 年 7 月,市面上已经有 24 个以上能打的 AI 编程 Agent,每个都要单独配 API。 更让人崩溃的…- 1.1k
- 0
-
Claude Code 把浏览器塞进桌面端,前端开发的闭环终于短了一截
Claude Code 把浏览器塞进桌面端,前端开发的闭环终于短了一截 Claude Code 内置浏览器界面 写在前面 前端开发里最烦人的动作,往往不是写代码本身,而是那些被切窗口切碎的几秒钟:编辑器里改一行,浏览器里刷新一下;页面不对,再切回去补样式;交互有问题,又打开控制台确认。 Claude Code 桌面端这次新增内置浏览器,真正击中的就是这条反馈链路。它不是简单多了一个预览窗口,而是把…- 754
- 0
-
agent-development:Claude Code Plugin 的 Agent 开发标准答案
写 Agent 这件事,说起来门槛不高,但真正写出一个靠谱的,比想象中难得多。 大多数人的第一版 Agent 都是一个套路:把需求写进 system prompt,给几个工具,然后指望它能自己搞定。结果往往是它要么过于保守什么都不干,要么过于激进一顿操作全错。你反复调 prompt、换模型、加约束,效果还是不理想。问题不在于你不够努力,而在于你从一开始就没按正确的结构来搭。 Anthropic 在…- 1.2k
- 0
-
Omnigent:Databricks 开源的”调度塔”
你有没有过这种感觉:上午让 Claude Code 写了个新功能,下午发现 Codex 的代码风格更好,想换过去重写,结果发现两个工具的会话、上下文、权限配置完全对不上。切过去要重装插件、重配模型密钥、重写 Prompt。 不只是你一个人有这个痛点。实际上,整个 AI 编码 Agent 领域过去半年爆发式增长之后,遇到的最大问题已经不是"哪个 Agent 更聪明",而是&quo…- 1.1k
- 0
-
Cognee:用知识图谱给 AI Agent 装记忆,比你想的更有野心
如果你在过去一年里关注过 AI Agent 的记忆方案,Mem0 和 Zep 这两个名字大概率不陌生。Mem0 走的是向量优先路线,47K Stars,五分钟集成,主打用户偏好记忆。Zep 用时间知识图谱追踪对话中的事实变化,在 LongMemEval 上跑出了 63.8% 的分数。 然后 Cognee 出现了。它既不是向量优先,也不是对话优先,而是选了一条更重的路:知识图谱优先。 Cognee …- 1.1k
- 0


































