-
Gemini 4正式发布,追平GPT-6但被质疑“刷榜”
AI 圈最近的更新速度,已经快到让人有点跟不上。 以前 OpenAI、Anthropic、Google 这种顶级玩家发布一次旗舰模型,市场通常会消化几个月。 现在的节奏完全变了。 你刚开始研究一个新模型,下一场发布会已经在路上。 就在 OpenAI 和 Anthropic 不断推进下一代模型的时候,谷歌 DeepMind 终于拿出了自己的年度旗舰: Gemini 4 Argon。 这次发布,谷歌给…- 4.3k
- 0
-
突发!Claude、GPT发布新模型,大降价对标DeepSeek?
今天凌晨,OpenAI和Anthropic几乎前后脚更新了模型。 Anthropic 发布 Claude Opus 5.5,OpenAI 则一口气发布 GPT-6 Sol 和 GPT-6 Luna。 有点像约好了。 而且两边这次升级的方向都很一致:能力继续涨,但重点开始放在速度、价格和实际干活效率上。 先看Claude Opus 5.5。 这次主要升级了几个地方: 1、Coding 更强了。 An…- 2.3k
- 0
-
FDE这么火,产品经理要不要跟?
最近后台被问得最多的一个问题: "杰哥,FDE是不是产品经理的新出路?" 我理解大家为什么心动。你去看看FDE的面试题就知道了。有人在Reddit上整理了一份Anthropic的FDE面试指南,里面的题大概是这样的: 一家银行想用AI自动化分析师的工作,第一步干什么? 客户买了AI、搭了系统,结果说不好用,是模型的锅、数据的锅、权限的锅,还是工作流选错了? 老板要让Agent直…- 3.2k
- 0
-
Claude重大合并,腾讯会抄作业吗?
就在刚刚,Anthropic 宣布将 Claude Chat 与主打复杂任务处理的 Cowork 合并为一个统一版本的 Claude。 以后不用再纠结“这事该去 Chat,还是该扔给 Cowork”,入口收成一个 Claude。至于你是随口问一句,还是甩过去一堆活,让 Claude 自己判断怎么接。 消息看起来只是产品改版,但我看到这里,脑子里突然蹦出了另一个名字:腾讯。 因为这招,腾讯可能真的该…- 1.4k
- 0
-
垂类业务如何落地生产级 Agent
AI 技术正在以前所未有的速度迭代,Agent、Loop-Engineering、Skills、Harness、LLM-Wiki、RAG、Memory等概念在短期内几乎同时涌入工程讨论,Demo 的构建门槛被持续压低——可视化编排加上 Vibe-Coding,一个过去需要数周才能搭起来的演示,如今往往几天或者在更短的时间内就能跑通。但进入企业生产环境之后,稳定性、可控性、可审计性和业务闭环能力,仍…- 1.3k
- 0
-
对话 Cursor 人才负责人:迷信大厂Logo的AI团队,往往最先招到平庸的人
过去二十年,Adam Ward 几乎亲历了硅谷每一轮人才战争。他曾在 Facebook 领导覆盖十个办公室、65 名招聘官的全球团队,推动技术团队从约 1000 人扩张至超过 1 万人;此后又执掌 Pinterest 全球招聘,将公司从 200 人带到 2000 多人。后来,他联合创办精品招聘公司 Growth by Design,公司被 Cursor 全资收购,他也由此成为 Cursor 人才负…- 2k
- 0
-
Claude Mythos 5.1 评测:被锁在玻璃箱里的”地表最强”孪生模型
写代码卡了许久找不到根因?做科研想让 AI 直接跑实验验证?Claude Mythos 5.1 就是 Anthropic 为这种高风险专业场景留的"后门"。它和人人可用的 Fable 是同一个模型,只是安全围栏松了一档。基准测试跑出超六成得分,但普通人根本申请不到。 产品概述 Claude Mythos 5.1 是 Anthropic 在 2026 年 9 月 1 日甩出的两张…- 1.3k
- 0
-
AI互联网日报:字节跳动推迟豆包2.2、华为云发布病理大模型、小米实测续航1230公里
一个数字落进了长期账本:25%。Anthropic把Claude Code临时增幅的一部分写进长期周限额,字节跳动则推迟豆包大模型2.2,要把编程和工具调用再磨一遍。前者把短期优惠变成稳定供给,后者宁可晚一点上线,背后都在回答模型怎样持续交付,而不只是在发布当天漂亮。因为真正留住用户的,从来不是一场演示,而是每次打开都能把活干完。 一起来看看这两天发生的AI和互联网赛道的大事件吧! 📌 今日AI互…- 2.1k
- 0
-
那些被管理层请进公司,却不被一线员工接受的FDE们。
前段时间,我在我们社群里看到一句话。 站在台上讲企业AI改造时,是受人尊敬的老师、专家和权威。 但真正进入客户现场以后,FDE就会变成乙方和供应商,甚至是被使唤、没权限、还要担责的奴隶。。。 这句话,可以说真的过于真实了。 FDE,其实是我一直很感兴趣也想和大家聊聊的职业。 全称为Forward Deployed Engineer,被译为前沿部署工程师。 就是进入客户的现场,根据企业的需求,推动一…- 1.2k
- 0
-
一篇讲透Agent自进化飞轮怎么搭:评测→记忆→落地→控制
你的 Agent 上线半年了。回头看看——它比第一天聪明了吗?它可能还在犯三个月前就犯过的错。还在重复三个月前就走过的弯路。还在对三个月前就见过的场景表现得像个新手。半年的线上流量喂过去,它一点经验都没攒下来。问题不在模型不够强。问题在于——没有人给它搭一条从"做过"到"记住"到"变好"的路。这篇文章基于对 Anthropic 递归自改进…- 1.3k
- 0
-
用下这 3 个 GitHub 上的超精简 Skill,内容只有几句话,却很好用。
01 去除写作 AI 味儿 这个是我开源的一个 skill,就几行指导性的文本。 但能有效去除 AI 生成文本的 AI 味儿。 比如,使用 Claude Code + GLM模型,输入:生成一个文章,介绍一下 AI 大模型浪潮。 输出完了,看看这个文章。 不出所料呀,各种 AI 味儿扑面而来。 详细最近两年,看各种自媒体文章的时候也应该看到下面这种类似的表达和痕迹。 我把这个生成的文章,丢进 AI…- 1.5k
- 0
-
AI互联网日报:特斯拉车机接入豆包和DeepSeek、DeepSeek上线多模态、豆包办公应用升温、阿里Accio商家超5万
8GB内存都开始被拿来讨论本地跑Kimi K3,DeepSeek又把视觉能力补上了。字节跳动还准备把豆包里的工作任务拆成办公AI应用,车机、电脑和文档都在被同一类助手接管。老曹这次看到的不是功能堆料。我会把它看成入口竞争变得更贴身:模型能不能进到真实设备和真实流程里,决定用户到底愿不愿意把任务交出去。 一起来看看这两天发生的AI和互联网赛道的大事件吧! 📌 今日AI互联网大事件速览 1,DeepS…- 3.4k
- 0
-
对话 Anthropic 产品负责人:不懂评测的 AI 产品负责人,只是在假装做产品
2023 年,Dianne Penn 加入 Anthropic 时,这家公司的产品团队只有五名工程师,整个 API 业务由一名工程师负责。当时,OpenAI 已经凭借 ChatGPT 和 GPT-4 建立起领先优势,Anthropic 还在寻找自己的产品定位。 三年之后,作为 Anthropic 首位技术产品经理、现任 AI Research 与 Labs 团队产品负责人,Dianne 参与了从 …- 1.2k
- 0
-
AI互联网日报:阿里出售游戏业务转向AI、腾讯游戏营收超650亿元、DeepSeek分时计价生效
入口这件事,已经从按钮变成工作流。说句实在的,我看DeepSeek开始按时段定价,OpenAI把开发大窗口放进账号体系,就知道工具竞争正在进入成本和权限管理。华为把智能座舱方案带到深蓝G318,Amazon也把争议处理条款前置,平台正在把服务、规则和责任一起打包。任务越被系统接走,收费、数据和交付边界越要讲清楚。 一起来看看这两天发生的AI和互联网赛道的大事件吧! 📌 今日AI互联网大事件速览 1…- 1.5k
- 0
-
我翻完 12 个热门 AI PPT Skills,发现大家已经不是做同一种 PPT 了
大家好,我是 Ai 学习的老章 上周我写Codex 正在杀死 PPT 软件,当时判断:PowerPoint 以后还会存在,但它会慢慢退到最后交付文件的位置 这几天我又去 GitHub 和 X 上翻了一圈,把目前讨论最多、Star 比较高的 AI PPT Skills 找了出来,认真研究之后,我发现 AI PPT 已经分成了三条完全不同的路 有的坚持做真正可编辑的 PowerPoint 文件,有的干…- 1.6k
- 0
-
猿辅导前妙多研发负责人,想把 AI 变成能独立干活的同事
数字员工逐渐走进团队。 6月下旬的时候,Anthropic发布了Claude Tag。 它并不是第一款强调AI同事概念的产品,但它的出现却让这种产品形态变得更加具体。Claude可以直接加入公司的公共频道,持续获得团队讨论里产生的Context。 成员交代一件事以后,它会调用已经获得授权的工具继续处理,也能给自己安排之后需要继续完成的工作。 更重要的是,它不再完全等待人来发起任务。一些长期没有处理…- 1.2k
- 0
-
Agent-identifier:用一套 Prompt 模板把 Agent 创建变成工程问题
在 Claude Code 里创建 Agent 这件事,看起来门槛很低。建一个 markdown 文件,写一段 system prompt,放到 agents 目录,完事。但真跑起来你会发现,Agent 不触发、触发了行为跑偏、或者 prompt 太长 Claude 直接忽略关键约束,这些问题出现的频率远比想象中高。 agent-identifier 是 Anthropic 在 Smithery.…- 1k
- 0
-
AI互联网日报:DeepSeek与Kimi压低缓存成本、抖音豆包酒店入口开始抽佣、拼多多明天达切入即时零售、Meta开源Muse Glimmer
先看账本。入口越来越贵,省下来的成本也越来越会换主人。Anthropic把Claude Code自动模式默认打开,应用商店也开始松动分发和支付边界。美团、京东被拼多多“最快明天达”逼到履约效率桌上,我这次看到的不是单点功能升级,而是平台把助手、支付、分发和物流塞进同一条工作流里。少一步,就多一笔议价空间。 一起来看看这两天发生的AI和互联网赛道的大事件吧! 📌 今日AI互联网大事件速览 1,Dee…- 1.2k
- 0
-
Rule-identifier :把团队编码规范写成 Hookify 规则
你让 Claude 帮你写了一下午代码,临近提交时例行扫了一眼 diff,差点心梗。三个 console.log 裸奔在页面脚本里,硬编码的 API 密钥藏在环境变量文件里,还有一个 rm -rf 连着绝对路径虎视眈眈。这已经不是 Claude 不行的问题了,它写完代码就下班了,但审查是你的事。 AI agent 干活的场景越来越密,但"守规矩"这件事对模型来说是个盲区。它不知…- 1.1k
- 0
-
Prior Auth Review Skill:把 30 分钟 PA 审批压进 5 分钟
Pre-authorization。PA。预授权审批。不管你怎么叫它,这个词在任何一个美国医保支付方机构里,都是运营成本的吞噬黑洞。 传统流程是这样的:医生提交 PA 申请,附上病历、诊断代码和诊疗方案。支付方的审阅员坐下来,打开 CMS 政策文档,逐个核对三件事:诊断码和诊疗码是否匹配,覆盖政策是否支持,以及医疗服务提供者是否资质齐全。一份申请平均耗时 30 到 60 分钟。问题是其中 40% …- 1.1k
- 0
-
Executive-briefing :Anthropic 这个 Skill 把“向上管理”做成了一行代码都不写的事
你有没有过这种经历:花了两天做调研,数据堆了一堆,结论其实很清晰,但要把这些写成一份领导愿意看的简报,反而卡住了。不是内容不够,是不知道怎么砍。 说实话,这个问题比“没东西写”更折磨人。你知道答案在哪,但每次打开文档,第一行就是改不出来的。你改了三版,最后领导扫了十秒钟,问了一句“所以核心结论是什么?”,那一瞬间你就知道,这稿白写了。 executive-briefing 这个 Skill 干的恰…- 997
- 0
-
Claude Opus 5 深度评测:半价追平 Fable 5,Anthropic 这波有多猛?
花了半年等 Fable 5 降价?Anthropic 直接甩出了更狠的一手。Opus 5 在编程、复杂推理和 Agent 任务上逼近 Fable 5 的表现,价格一刀砍半。更低成本、更高效率,还默认开启了思考模式,这次的 Opus 升级不是挤牙膏,是直接换赛道。 产品概述 Claude Opus 5 是 Anthropic 在 2026 年 7 月 24 日发布的新一代旗舰大模型,定位为日常高频使…- 1k
- 0
-
create-an-asset :从客户信息到品牌化交付物,一个 Skill 串起整个售前流程
你有没有遇到过这种情况,销售说"帮我出个方案,客户明天要",然后你就开始手动拼 PPT,从公司的产品介绍里摘功能点,对着客户的行业背景硬编几个"定制化价值主张",最后再调两个小时的排版和配色。说实话,这套流程重复了无数遍,早就该自动化了。 Anthropic 在 GitHub 上开源了一个叫 create-an-asset 的 Skill,目前在 Smith…- 1.1k
- 0
-
legal-risk-assessment :从”感觉”到”数字”,法务风险评估终于不再靠猜
法律风险管理这件事有个很诡异的地方:大部分法务团队天天在做的事,居然没有一套标准化的操作流程。问一个法务"这个合同风险大不大",回答可能是"还行"“有点悬”“问题不小”,但你很难得到一个精确的数字。 不是法务不专业。法律风险评估天然带有主观性,同一个条款在不同行业、不同公司甚至不同时点的判断都不一样。但你想过没有,如果一个公司连财务风险都能量化到小数点后两位…- 1.2k
- 0








































