-
任何错误只犯一次:TencentDB Agent Memory 的团队记忆实践
当执行能力趋于充裕,组织如何重建信息流动与经验继承 Coding Agent 正在快速扩大一个人的工作边界,但企业研发的瓶颈并没有因此自动消失。任务一旦跨越成员、Session、代码分支和权限域,真正稀缺的往往不是生成代码的能力,而是“协作的带宽”。本文从 OPC、协作带宽和孙天祥提出的三层 AI 组织架构出发,重点介绍 TencentDB Agent Memory 在团队记忆上的工程实践:我们如…- 1.2k
- 0
-
DeepSeek Harness 实测:Codex 9 分钟搞定,V4 Pro 20 分钟搞不定
8月13日晚,DeepSeek 开源了 DeepSeek Harness。 其实,从他们此前公开表示要进军 Agent 领域、并开始招聘 Agent 团队时,我就一直猜测,DeepSeek 迟早会推出一款对标 Claude Code 或 Codex 的产品,甚至连名字我都替它想好了,就叫 DeepCode。 没想到,率先亮相的竟然是这个 Harness。 其实我想要的是一个DeepCode,然后提…- 1.2k
- 0
-
字节内测“漫剧创作工具”:搭载豆包大模型,支持20万字剧本上传
《读佳》获知,字节正在内测一款漫剧创作产品,名字就叫“漫剧创作工具”,Slogan“让创作更纯粹”,搭载豆包多个大模型。 该产品是字节专门针对漫剧赛道,面向内容创作者与内容公司打造的AIGC创作平台,支持从剧本上传、项目规划、剧本策划、资产设计、分镜生产到视频合成的完整创作流程,让创作者更高效地完成漫剧内容生产。此外,也可以绑定抖音短剧创作者中心账号,绑定后即可开启跨端数据互通。 当前工具处于内测…- 1.2k
- 0
-
千问办公开源MyContext,为Agent提供工作场景上下文基础设施
近日,千问办公开源上下文基础设施项目"MyContext"。 它可将IM沟通、文档、会议等多源工作数据加工为Agent可理解的专属工作档案,提升Agent在工作场景下的表现。项目开源一周已获超1k Star。 MyContext以本地化方式运行于用户设备,将钉钉、飞书等IM系统、文档、会议与协作记录中的多源数据,自动沉淀为持续更新的工作档案,包含职责范围、协作关系、行为习惯与工…- 1.3k
- 0
-
Harness 工程之道:Skill 原理与最佳实践
Agent Skills 是一种轻量、开放的能力扩展规范,用于为 AI Agent 扩展专业知识和工作流。本文从概念原理出发,结合真实的工程化项目 trade-ab-skill,系统性地讲解 Skill 的结构规范、触发机制、作用域优先级,以及最佳实践。(文章内容基于作者个人技术实践与独立思考,旨在分享经验,仅代表个人观点。) 01、Skill 的产生与核心理念 1.1 从 Prompt 工程到 …- 1.3k
- 0
-
Agent的上限,可能不在模型,而在团队知识
当 Agent 成为团队一线生产力,知识供给的问题随之暴露:检索不准、注入低效、过时内容越堆越多。本文记录安全中心团队从定目标、搭体系到跑通知识飞轮的完整过程,包括关键决策背后的思考、踩过的坑,以及可直接复用的方法。当团队开始用 Agent 做研发和运营,一个问题很快浮出来:Agent 的输出质量,直接取决于你能给它什么质量的知识。怎么让知识「产得出、找得准、喂得进、淘汰得掉」,是每个上了 Age…- 1.2k
- 0
-
DeepSeek Harness 全景可观测实践
AI 编码 Agent 真正跑起任务后,问题往往不再是“它有没有完成”,而是:这一轮为什么花了 47 秒?时间卡在模型还是工具?失败后重试了几次?Token 消耗来自主 Agent 还是 Subagent? DeepSeek Harness(下文简称 DSH)已经保存了很完整的 Session 日志,但要回答耗时、调用关系和成本问题,还需要把事件组织成 Trace 和 Metrics,才能看清问题…- 1.2k
- 0
-
花几天把 DeepSeek Harness 跑了个遍,跟你说说值不值得装
大家好,我是跟"单身汉"混了几天的林月半子。 8月13号,DeepSeek 开源了一个叫 DSH(DeepSeek Harness)的 Agent 框架,这几天一路涨到破 10 万。 有人给它取了个中文外号:单身汉。别笑,这个"单身汉"还挺能干活的。 DeepSeek 官网首页四个大字:一切皆插件。GitHub README 第一句也是 "Ever…- 1.2k
- 0
-
说一个反常识的真相,Agent如今在真实工作场景的成功率依然很低。
上周一,我发了自己做的AIHOT大模型排行榜。 有很多朋友感兴趣,在文章下面评论,最高赞的一条,是在问能不能有个分类测评,能够评估不同模型做不同任务的表现。 讲道理,这其实一直是我想做的,也是我觉得特别特别核心的痛点。 现在的大模型榜单很多,比如LiveBench、DeepSWE之类的,可以很快知道哪个模型在某一个能力维度上更强,像Coding、数学、浏览器操作等等。 但是有一类评测集,其实是最稀…- 1.2k
- 0
-
AI时代的数据研发-Semantic(语义层)实践总结
本文总结了AI时代数据研发从传统SQL开发向Semantic(语义层)+ DataAgent范式转型的实践与思考,指出传统模式存在效率低、语义鸿沟及口径不一致等瓶颈,而通过构建包含指标、维度、逻辑表及CTE适配层的语义层,结合Meta-ontology本体论和Wiki-RAG检索增强,实现了业务语义的结构化定义与AI自动翻译NL2SQL;该方案采用Agentic架构双轨制,将数据知识从代码迁移至语…- 2.1k
- 0
-
DeepSeekHarness的新范式:让Agent为自己构建工具
关于 DeepSeek Harness 的这套插件逻辑,可以用这个例子来理解: 你在开会时,突然想“公司要是有个内容运营能一起参与讨论下该多好啊”,如果想要实现这个想法:过去,你得安排 HR 招人,招到了重新开会,开完讨论完还不能随便裁掉;现在,你可以直接“捏”一个内容运营加入到会议,讨论完直接把他优化掉。 过去,Agent 会话一旦启动,我们就不能往里塞工具了,那些 Agent 客户端也不允许我…- 1k
- 0
-
相比层出不穷的 Agent 框架,不变的 Agent Protocol 是什么
Agent 框架层出不穷,到底哪个值得长期投入? LangGraph 讲 Checkpoint,OpenAI 讲 Thread 和 Run,A2A讲 Task,AG-UI 讲 Event,Deep Agents 又引入 Todo、Subagent 和 Virtual Filesystem。名字越来越多,API 越来越像一套套独立世界观。 框架名词在变,但底层问题始终围绕任务、上下文、步骤、事件、状…- 1.3k
- 0
-
偷偷分享 DeepSeek Harness 热榜挖到的 2 个实⽤插件
大家好,我是苍何。 太猛了,DeepSeek Harness 截至当前已经 112 k 的 Star 了,而这距发布仅仅过去三天。 而且还在以惊人的速度增长... DeepSeek Harness 的核心就是:一切皆插件。 模型、工具、技能、会话甚至是 UI 都插件,可以自由插拔组合。 说个不确切的比喻,有点 Agent 时代的 Obsidian 感觉了,自由度太高了。 DeepSeek Harn…- 1.1k
- 0
-
开源一个公众号排版 Skill:彻底解决排版难题(建议收藏!)
大家好啊,我是甲木, 这几天趁着还能用「天才程序员」,跟小李一起把 公众号排版 Skill 打磨了一下。 之前我们每次发布内容,都会有朋友问文章怎么进行排版的,今天直接把 方法论和代码库开源出来 供大家使用~ AI 排版要保证既有阅读路径,又不影响复制粘贴。 既有审美判断,又能稳定复用 。试了几轮之后,效果比我们预期好很多。 而且在 国产 Agent 上统统适用 !WorkBuddy、TraeWo…- 1.3k
- 0
-
实测GLM 5.3|重回开源国模一哥
长程调度,Agent Loop,这两个词,圈里喊了大半年,你随便刷个技术社区都能看到 乍一听挺唬人。翻译过来其实就一句话:让 AI 自己把一件大事,拆成很多步,一步一步做完,中途还记得自己为啥在干 这几个月,DeepSeek、Kimi、Qwen 都在验证这条路线。今天智谱也发了GLM-5.3 官方说,通过通过极致的后训练 Scaling:数十倍的长程任务环境、更丰富多样的环境类型、超长的后训练时间…- 1k
- 0
-
猿辅导前妙多研发负责人,想把 AI 变成能独立干活的同事
数字员工逐渐走进团队。 6月下旬的时候,Anthropic发布了Claude Tag。 它并不是第一款强调AI同事概念的产品,但它的出现却让这种产品形态变得更加具体。Claude可以直接加入公司的公共频道,持续获得团队讨论里产生的Context。 成员交代一件事以后,它会调用已经获得授权的工具继续处理,也能给自己安排之后需要继续完成的工作。 更重要的是,它不再完全等待人来发起任务。一些长期没有处理…- 1.2k
- 0
-
DeepSeek Harness 实测|模型之外的那一半,到底带来了什么
DeepSeek-V4-Pro 正式版上线当天,DeepSeek Harness 也开源了。之前注册Deepseek Harness公众号已经吵闹过一阵。V4 Flash 发布报告的模型卡里只漏过一句 DSH,外界却已经猜测了很久,可谓期待值拉满了。 源码摊开以后,预期和实物略有点对不上号。很多人等的是 DeepSeek 版 Codex。当前开源的这套东西更像还能继续造 Agent 的 runti…- 1.3k
- 0
-
我扒了 DeepSeek Harness 219 个包,真有价值的是插件内核,附插件推荐
昨天我把 DeepSeek Harness 装上跑了一轮:DeepSeek Harness 安装,初体验,没有惊喜。 写的比较仓促,仅仅是从安装到使用走了一遍。上午我把官方仓库整个拉下来,让 AI 分析了一下,从启动配置一路翻到 Agent Loop、会话事件、工具管线、上下文压缩和插件加载,很多看到的地方,确实有很多 DeepSeek 的设计巧思 省流:本文有AI味,不喜请立即马上迅速叉掉 De…- 1k
- 0
-
DeepSeek Harness 安装,初体验,没有惊喜。
千呼万唤始出来,DeepSeek Harness 发布了,先说个冷知识,DeepSeek Harness 是用 Claude Code 开发出来的 如果你还在好奇 Harness 到底是什么,最简单理解: 除模型本身以外的所有工作,都属于Harness的范畴 基座大模型相当于智能体的“大脑”,负责推理、理解需求、生成代码;读文件、改代码、执行命令、组织上下文、调用工具、保存会话、申请权限、派发子 …- 995
- 0
-
高德汽车工程 AI Native 演进实录|AutoSDK AI Coding 可观测与自进化闭环的构建
汽车产业正从“软件定义”驶向“AI 定义”的深水区。在百万级代码、企业级 SDK 交付的工程场景下,我们面对的已不只是“AI 能不能写代码”的疑问,而是“AI 能否像工程师一样稳定交付”的工程命题。 过去数月,高德汽车业务中心进行了一场系统性实践。我们将这段旅程总结为四篇文章: 架构篇:高德汽车工程AI Native演进实录|AutoSDK全链路AI Native开发 知识篇:高德汽车工程AI N…- 1k
- 0
-
DeepSeek Harness 拆解:一套能拼装的 Agent 架构
DeepSeek 发布了第一款 Agent 产品,DeepSeek Harness。这次的重点放在了运行时架构上,官方给的关键词是"everything is a plugin",模型接入、工具执行、会话记录、循环本身、界面,全部走插件机制。 这篇文章跳过 agent 领域已经成为共识的那部分——检测工具调用、执行、回填、循环,这套流程眼下几乎每个框架都长一个样,不值得再讲一遍…- 1k
- 0
-
智谱GLM-5.3发布:前沿编程能力与涌现的网络安全能力
单弦不成音,独木不成林 今天我们发布GLM-5.3,与GLM-5.2相比,基座模型没变,但通过极致的后训练Scaling大大提高了模型的智能上界:数十倍的长程任务环境、更丰富多样的环境类型、超长的后训练时间。我们发现充分的模型后训练涌现出超出预期的模型能力。相比前代,GLM-5.3的新能力包括: 更强的编程能力。GLM-5.3是编程能力最强的开源模型,在内部自建体感评测中较GLM-5.2提升50%…- 1.5k
- 1
-
Qoder CLI 支持会话之间传话了,再也不用当人肉传话筒了
Qoder CLI 现在支持跨会话消息了。同一台机器上的多个会话可以互相发现、直接通信。 告诉你的 Agent 一声,它就能把信息同步给其他会话,你再也不用当人肉传话筒了。 目前此功能仅支持 macOS 和 Linux 系统,升级到 1.1.19 及以上版本即可使用。 怎么用 第一步:开启功能 当前此功能处于 Beta 阶段,默认关闭,需要通过环境变量手动开启: QODER_FEATURE_CRO…- 1k
- 0
-
重构协同:关于AI Native团队的思考
本文指出当前AI提效陷入“单点优化、全局低效”困境的根源在于协同缺失,主张通过重构生产侧将流程串联者从人转变为Agent,构建以“知识底座+Agent+人”为核心的AI Native团队闭环形态,其中人负责目标与判断,Agent基于统一的知识底座承担执行与串联;文章强调软件是被固化的知识,而实现该形态的关键瓶颈并非协同工具,而是如何为存量业务构建具备自治能力、能清晰定义业务规则与流程且可持续更新的…- 1.9k
- 0






































