-
World Model(世界模型):AI开始有”想象力”了
你有没有想过这个问题: 当你说"把杯子推下桌子",你的脑子里发生了什么? 你可能看到了杯子摇了一下、然后倒下、最后摔在地上——甚至能听到"啪"的一声。 这个过程,你没有真正看到,但你在脑子里"模拟"了一遍。 这就是人类的世界模型——我们有一个对世界的内部模拟,知道动作会导致什么结果。 World Model(世界模型),就是让AI也拥有这…- 926
- 0
-
Kimi K2.6 实测:能干 13 小时活的代码 Agent
一个模型连续编码 13 小时不崩盘,还帮你多线程并行调度 300 个 Agent,Kimi K2.6 在长程编码和 Agent 协同这两个维度上,确实把国产开源模型的天花板又撞高了一截。但换个赛道看,推理和数学能力跟第一梯队之间还隔着一条明显的缝。从 12 小时用 Zig 优化推理引擎,到 4 轮对话生成全栈应用,它是会把开发者惯坏的那种工具。前提是,你得知道它擅长什么,不擅长什么。 这是个什么模…- 189
- 0
-
Skills Registry 公测开启:为企业打造私有的 Skill 管理中心
AI Registry 是阿里云微服务引擎 MSE 推出的全托管 AI 资产注册中心,是 Nacos AI Registry 能力的云服务 SaaS 版本。底层基于 Nacos 构建,客户端直接使用 Nacos SDK 接入,已经在用 Nacos 的团队可以零学习成本上手。它为 Prompt、Skill、Agent 等 AI 资产提供统一的注册、版本管理、发现与治理能力,帮助企业建立规范化的 AI…- 1.3k
- 0
-
MiMo-V2.5 评测:小米的 310B 全模态 Agent 到底猛不猛
写代码到一半突然要切去调音频、看文档、分析视频,一个模型搞定所有模态,这事以前是奢望。小米 MiMo-V2.5 系列,310B MoE 架构、1M 上下文、全系开源,Pro 版在 SWE-bench Pro 上跑到 57.2%。实测用它接 Claude Code 写了一套公众号数据分析平台,一次部署成功。API 价格比 Claude 便宜六成,V2.5 版本每百万 token 输入才 7 块钱。到…- 191
- 0
-
Seed3D 2.0 评测:字节跳动的 3D 生成大模型,到底能不能进生产线?
生成一个 3D 模型以前要多少步?建模、拓扑、UV 展开、贴图绘制,少说半天。Seed3D 2.0 想做的是一张图或一段文字,直接端到端出模型,而且是带 PBR 材质的工业级资产。Coarse-to-Fine DiT 架构加上 MoE 稀疏专家路由,几何和材质双维度拿下 SOTA。到底有没有这么强?从核心功能到上手体验,挨个试了一遍。 简单说说 Seed3D 2.0 是字节跳动 Seed 团队在 …- 566
- 0
-
Qoder正式支持远程控制,一部手机随时随地掌控你的所有 Agent
今天,我们非常高兴的宣布,Qoder 正式支持远程控制(Remote Control)。Web 版已上线,iOS、Android 移动端上架中。 首发支持接入Qoder CLI;Qoder、QoderWork 及数字员工 QoderWake 会在近期完成接入支持。 移动端正在陆续上架各应用商店,也可以通过Web端立即远程控制你的Qoder CLI。 远程让 Agent 帮你干活这件事,大家应该都不…- 1k
- 0
-
Step Image Edit 2 评测:3.5B参数凭什么打赢12B级对手
写个海报背景图还得等十几秒?换文字就得重新P图?Step Image Edit 2 可能就是来治这个病的。3.5B 参数的小模型,出图 0.5 到 2 秒搞定,API 才两分钱一张。文生图、局部编辑、文字渲染、风格迁移、视觉推理、主体一致性保持,六个功能打包在一起。在 KRIS-Bench 轻量图像编辑榜单上还拿了第一,超过参数大它三四倍的对手。到底有没有这么神,上手试了一遍才知道。 产品概述 S…- 101
- 0
-
终于有人从AI的底层,把Figma重新做了一遍
设计工具这个赛道,Figma已经称霸太久了。 久到什么程度?久到很多年轻设计师已经默认,设计工具就长这样,云端协作、组件系统、自动布局,这些不是功能,是空气,是理所当然。 但空气里开始有一股不一样的味道。 去年开始,AI生成图片、AI生成视频、AI生成3D,一波一波地来。设计圈的人一直在等,AI什么时候来搞设计工具?不是加个AI插件的那种,是从根上重新想一遍,如果AI是设计流程的默认参与者,设计工…- 1k
- 0
-
AI大事件:谷歌、微软、亚马逊、Meta四大科技巨头财报同日公布;9所高校获批开设具身智能本科专业
有件事挺有意思——就在两天前,OpenAI还被《华尔街日报》爆出"营收和用户双未达标",昨天Altman立刻反击称"标题党,业务火力全开"。今天谷歌、微软、亚马逊、Meta四大科技巨头财报同日公布,用真实数据给AI砸进去的几千亿美元交了答卷。结论是:AI的钱没白花,但不是每家都让市场满意——谷歌云暴涨63%盘后涨7%,Meta上调资本支出被直接砸盘。与此同时…- 1.4k
- 0
-
阿里数字员工QoderWake正式发布!Qoder移动端同步上线
刚刚,阿里正式发布数字员工QoderWake和Qoder移动端两款Agent产品,全面覆盖企业和个人场景的需求。 QoderWake是业界首个安全可控、持续进化的生产级数字员工产品,能在真实工作中承担软件工程师、运营和分析师等岗位角色。 目前,QoderWake已开启邀测,个人和企业均可在官网申请雇佣一位或多位数字员工,或根据自身业务流程定制专属数字员工。 QoderWake生产级数字员工发布 Q…- 1.4k
- 0
-
Qoder Skills 完全指南:从零开始,让 AI 按你的标准执行
阿里妹导读 文章内容基于作者个人技术实践与独立思考,旨在分享经验,仅代表个人观点。 在 AI 原生工作流加速普及的今天,掌握 Skill 已不再是开发者的专属能力,而是产品、运营、设计乃至技术管理者提升人机协同效能的核心职业素养。它直接决定你能否把模糊需求转化为稳定、可复用、可协作的 AI 执行单元,从而在项目交付中显著提升质量一致性、降低沟通成本、规避重复试错。 一、理解 Skill 的本质:菜…- 1.6k
- 0
-
全网最全 Claude Code 命令指南:会话、权限、扩展、自动化全搞定!从新手到大神,这一篇就够了
Claude Code 又双叒叕更新了!!! 如果你平时没有持续盯着它的版本变化,隔一段时间再打开,大概率都会有一种熟悉又陌生的感觉:怎么又多了新命令,怎么又冒出来一些之前没注意过的新能力... Claude Code 更新是很快的,但真正被大多数人用起来的,往往还是最基础的那几个命令,多数情况也就够了。 所以很多人对 Claude Code 的使用,还停留在“打开终端,开始对话”的阶段,最多再用…- 1.5k
- 0
-
Lenso.ai 深度评测:AI 反向搜索能做到多准?
Lenso.ai 是一个基于 AI 的反向图像搜索引擎,支持地点、人物、重复、相似、相关和文本六大搜索类别。它能帮你找到图片里的地点在哪、有没有被其他人盗用、某个人的照片出现在哪些网站上。平台还提供 Pro 研究模式、API 集成和高级筛选功能。对摄影师、版权维权人士和需要做开源信息调查的人来说,这是个难得的好工具。 简单说说 搜索一张图片能找到什么?Lenso.ai 给出的答案是:找到它拍摄的地…- 1.6k
- 0
-
近三个月设计圈AI新工具,盘点UI/UX全球27款AI设计工具合集!
哈喽大家好,我是萤柳!以前我们用 AI,可能只是让它帮忙出一张图、写一段文案、找一点灵感。现在不一样了,它已经开始深入到 UI/UX 设计的每一个环节:从页面生成、原型搭建、代码落地,到视觉素材、用户研究、内容优化,几乎每一步都有新的工具出现。所以我花时间整理了一份近 3 个月设计圈 AI 新工具合集分成 5 大类:UI 生成类、原型与代码类、视觉素材生成类、研究与内容类,以及近 3 个月最新发布…- 1k
- 0
-
TRAE × IGA Pages:TRAE 中国版如何快速实现一键部署
前言 想象这样一个场景:你是独立开发者、产品经理,或者负责活动落地页的运营同学。一个想法突然冒出来,借助 TRAE 中国版,你在一个下午就把原型跑通了。 但是真正的部署难题从这里才开始:你需要让本地能打开的页面,变成全球用户能访问的链接,中间要过一整条清单。它与业务逻辑无关,却常常决定了上线的节奏。 部署前,你可能要面对: 购买和配置服务器 繁琐的 Nginx 规则 编写复杂的 Dockerfil…- 827
- 0
-
CodeBanana 评测:当 AI Agent 开始替团队写代码、开会议、管项目
上周跟一位做 SaaS 的朋友吃饭,他吐槽团队里最痛苦的事不是写代码,而是"写完之后要同步给产品、测试、运营,每个人都在不同的工具里问同样的问题"。回来我搜了一圈,发现 CodeBanana 这个工具打的正是这个痛点,它把自己定位成"AI Agent 协作平台",核心逻辑是把 Agent、聊天、工作区三件事塞进同一个项目空间,让沟通直接变成执行。听起来有点理…- 63
- 0
-
GPT-5.5 评测:比 Claude 强多少?值不值价格翻倍?
一位做数据分析的朋友上周跟我吐槽,说 GPT-5.4 写代码写到一半总"犯傻",推理链断得莫名其妙。4月24日凌晨 OpenAI 突然甩出 GPT-5.5,号称"自 GPT-4.5 以来第一次完全重新预训练",定位不再是聊天机器人,而是专门干活的智能体引擎。用了几天之后我的感受是:它确实变聪明了,但代价也很真实。 先说说这是啥 GPT-5.5 不是 GPT-…- 85
- 0
-
「微信 ClawBot 经济」,已经开始在水面下悄悄成形了
昨天,我日常「监管」抖音的时候,刷到一条视频,看完后真愣了大概十秒钟。还以为熬夜熬的太狠,眼睛真花了。 一个我从来没听说过的小产品,居然把一个 AI 情感陪伴产品,做进了 微信的主联系人列表 里。 这事,真的很抽象。我第一反应是:腾讯怎么可能这么开放...... 微信这个入口被保护了多少年,懂得都懂。 我去深扒了一圈,发现这种产品在一些小众圈子里已经很火了,大有星星之火可以燎原之势。 这里,先把背…- 1.1k
- 0
-
官宣:阶跃 Step Image Edit 2 上线!小身材、大能力、快响应
今天,阶跃正式发布新一代图像生成编辑模型 Step Image Edit 2。 这是一款主打极速响应、高质量输出的轻量级模型,小身材、大能力、快响应! 其参数量仅为 3.5B,但在实际表现中实现了对 12B-20B 级开源图像编辑大模型的跨量级超越,单次生图仅需 0.5-2s。 核心提供图像生成与图像编辑两项能力,支持中英文渲染、局部编辑、视觉推理、主体一致性、风格迁移等。可覆盖 IP 创作、海报…- 995
- 0
-
AI手工测试用例的实践进阶之路
这篇文章分享一条真实的落地路径:我们不是直接追求“AI 一键生成完美用例”,而是先用 MVP 验证方向,再用 1.0 补齐输入解析、Prompt 工程化、知识工程和检索闭环,最后把能力沉淀到测试智能体并skill化赋能“小龙虾”。文末会给出可直接复用的实践方法与避坑点。 -- AI用例生成项目组 一、问题:传统手工用例在复杂业务下的挑战…- 1k
- 0
-
AI大事件:OpenAI营收用户双未达标、微软与OpenAI正式解绑、科大讯飞持续亏损
今天这期日报的数据密度很高。先看几组关键数字:英伟达市值冲破5.26万亿美元稳居全球第一,OpenAI营收和用户双双未达内部目标引发美股AI板块普跌,马斯克诉OpenAI"世纪官司"正式开庭,AlphaGo之父David Silver创业4个月融资11亿美元估值51亿。再看国内:小米MiMo-V2.5和商汤U1同日开源,GitHub Copilot宣布6月全面转按量计费,腾讯云…- 1.7k
- 0
-
平头哥真武PPU对Xiaomi MiMo-V2.5系列模型完成适配
近日,小米正式发布并开源MiMo-V2.5系列模型,平头哥完成对MiMo-V2.5-Pro的适配,成为首批实现适配的国内算力厂商之一。同时,MiMo-V2-Flash和MiMo-V2.5-Pro模型已上架阿里云PAI-Model Gallery。 MiMo-V2.5-Pro是小米公司迄今最强大的模型,拥有1T超大参数量、支持1M超长上下文的推理。在通用Agent能力、复杂软件工程以及长程任务等维度…- 753
- 0
-
Harness Engineering实践,做了一个平台让AI一晚上自动评测和优化你的系统
阿里妹导读 文章内容基于作者个人技术实践与独立思考,旨在分享经验,仅代表个人观点。 本文介绍一个我近期做的一个实践流程,快速搭建了一个小平台,基于这个平台可以做全自动化的评测,乃至于整个系统的全自动化优化,包括三个案例:1. 基础的全自动化无UI评测;2. 带UI的自动化评测,甚至评测UI里面的内容质量;3. 整个系统的自动评测+优化,来回往复进行三轮,优化一晚上。 一、准备一个评测平台 说起评测…- 1.1k
- 0
-
Hermes 的核心架构 Harness:上下文、工具、权限与执行控制
书接上文:OpenClaw vs Hermes:拆解 Hermes Agent 五层架构 上一篇写 Hermes-Agent,我们选了一条比较笨但好用的路:跟一条消息走一遍。 从终端里敲下一句话,到 Agent 把最后一个字回到屏幕上,中间其实绕了很长一圈: 消息先被入口收进去,变成内部统一的消息; 会话和上下文被重新组织; 模型开始一轮轮判断,必要时调用工具; 过程太长时,系统还要整理上下文、保…- 1.4k
- 0




































