-
Kimi Code Desktop 正式与你见面
今天,Kimi Code Desktop 正式与你见面。macOS 和 Windows 版同步上线,访问 kimi.com/code 开始安装使用。 作为 Kimi Code 官方桌面客户端,它将 Kimi Code 智能编程服务能力带到桌面应用中。你不仅可以在桌面端内直接使用 Kimi Code 的 AI Agent 能力,通过对话让它读写代码、运行命令、完成自动化任务,还能在全新可视化的图形交…- 2.1k
-
字节将发布独立智能网盘“ADrive”,腾讯网盘先已布局,网盘AI大战打响
随着AI办公、智能体应用逐步落地,云存储的核心价值正从“单纯存文件”,转向“数据沉淀、高效复用、人机协同”,国内头部互联网厂商也开始集中发力全新的智能网盘赛道。 《读佳》独家获知,字节跳动将在9月发布全新且独立的智能网盘产品ADrive,产品Slogan为“连接你的AI应用,让文件与产物持续可用”。该产品由火山引擎打造,是一款面向AI智能体与人类用户协同办公的企业级智能网盘,主打统一文件存储与团队…- 1.2k
-
DeepSeek V4.1 Flash 评测:一个 Flash 档模型,把自家旗舰挤下了线
给智能体跑长上下文,账单总比预期崩得快。DeepSeek 把 5520 亿参数的模型压到只激活 80 亿,KV Cache 砍到上一代的四分之一,闲时输出每百万 token 四块钱,榜单直接追平 Claude Opus。官方甚至把自家旗舰的请求路由到它身上。便宜归便宜,最难的那批榜它仍差一截,切换通知只给了一天。 产品概述 DeepSeek V4.1 Flash 是 DeepSeek 在 2026…- 1.4k
-
小米MiMo Desktop开放邀测:腾讯、阿里、字节又多了一个对手
刚刚,小米 MiMo 团队把 Xiaomi MiMo Desktop(下称 MiMo Desktop)的邀测闸门打开了,同时甩出两款新一代模型的预览版:MiMo-X-Pro-Preview 和 MiMo-X-Flash-Preview。我最大的感受是——这次小米几乎没谈跑分,所有话术都压在”交付”两个字上。这其实是个信号:桌面 Agent 的竞争,正在从”答得对不对”转向”能不能把活干完”。 真实…- 3k
-
MAI-Image-2.6-Flash 评测:千张出图压到 20 美元以内,微软这次卷的是账单
批量出图最难受的从来不是画质,是等,是账单按秒往上烧。MAI-Image-2.6-Flash 冲着这个痛点来的:微软称它比主流旗舰快一大截,千张成本压到 20 美元以内,图像编辑能力还能排进全球头部。是不是真有这么香,我把它接到 Foundry 和 OpenRouter 各跑了一轮再说。 产品概述 微软在 2026 年 9 月 4 日把自研图像模型的"快速档"正式摆上了货架。M…- 1.2k
-
QoderWake 1.0 评测:会自己开工的数字员工,到底行不行
团队里总有那么几件重复到麻木的活,半夜 CI 挂了没人盯、PR 堆着没人审、客户群里的问题没人回。QoderWake 1.0 想把这些活交给能进钉钉和飞书群、被 @ 就接活的 AI 数字员工。它不是聊天机器人,而是带工号、有记忆、能 7×24 自主值守的岗位同事。招一位上岗最快不到一分钟,用下来最直观的变化是:人只需要在关键节点拍板。 先搞懂它是什么 QoderWake 是阿里巴巴 Qoder 家…- 1k
-
腾讯做了一个AI接单匹配平台“企鹅搭子”
《读佳》获知,腾讯做了一个AI在线接单匹配平台“企鹅搭子”,据悉,企鹅搭子是腾讯可持续社会价值事业部(SSV)与当地政府机构联合试点发起的线上技能撮合平台,目前已试点面向电商图片设计、电商视频制作、短视频制作等可线上交付的任务,通过AI助理,为OPC与超级个体提供订单对接。现阶段,企鹅搭子项目已落地温州。 01 什么是企鹅搭子? 从已上线的企鹅搭子小程序首页界面来看,平台已经划分出电商视频、电商图…- 1.4k
-
GPT-6 Astra 深度评测:当 AI 开始自己干活
还在把 AI 的回答复制进 Excel 自己排版?新旗舰 Astra 想替你把这一步也省了。它能直接打开浏览器、填表格、跑代码、做 PPT,自己把活干完再交付。抽象推理基准 ARC-AGI 几乎满分,官方称这是 AGI 时代的开端。它到底有多能打,又贵不贵,上手试一遍才知道。 产品概述 OpenAI 在 2026 年 9 月 4 日(北京时间)发布了新一代旗舰模型 GPT-6 Astra,代号在拉…- 1.4k
-
Cheso:腾讯推出的 AI 演示文稿 Agent
做一份像样的汇报 PPT,光找模板、调版式就能耗掉半天。Cheso 想把这半天压缩成一句话:描述需求,剩下的调研、配图、排版交给 Agent。它会自己联网查资料、交叉核实来源,再产出 PPT、海报、网页甚至视频。腾讯这次把多模型路由藏到幕后,你只管提需求和验收。到底好不好用,看完这篇再决定。 产品概述 Cheso 是腾讯推出的 AI 原生演示文稿 Agent,官网 cheso.ai。它不像传统 P…- 1.2k
-
Gemini 3.8 Flash 评测:六分之一价格逼近 Opus 5,通用 Agent 仍是硬伤
跑一晚上 Agent,账单比模型本身还贵?Gemini 3.8 Flash 的答案是:用大约六分之一的价格,在终端编程和法律 Agent 上反超 Anthropic 旗舰。百万上下文、可调思考力度、Flash 级速度,一个不少。代价同样直接:输出只给 64K,通用 Agent 能力仍被甩开一大截。值不值得换,往下看。 先搞懂它是什么 Gemini 3.8 Flash 是 Google DeepMi…- 1.3k
-
Claude Mythos 5.1 评测:被锁在玻璃箱里的”地表最强”孪生模型
写代码卡了许久找不到根因?做科研想让 AI 直接跑实验验证?Claude Mythos 5.1 就是 Anthropic 为这种高风险专业场景留的"后门"。它和人人可用的 Fable 是同一个模型,只是安全围栏松了一档。基准测试跑出超六成得分,但普通人根本申请不到。 产品概述 Claude Mythos 5.1 是 Anthropic 在 2026 年 9 月 1 日甩出的两张…- 1.3k
-
MiniMax Design 评测:把 H3 装进产线,一句话出片到底行不行
一个月要出三十条投放素材,素材却散在下载文件夹、剪映、网盘和三个 AI 网页里?MiniMax Design 想治的就是这段手忙脚乱。海螺团队把 H3 视频模型和 GPT Image 2、Nano Banana Pro 塞进同一张节点画布,你只管说清要什么,四路 agent 分头干活。实测下来流程层确实跑通了,官方最主打的语义改视频却翻了车。 产品概述 MiniMax Design 不是又一个 A…- 1.3k
-
OpenClaw 2.0 评测:一只”意外”重做的龙虾,能否成为你的个人 AI 操作系统?
OpenClaw 2.0 是项目史上最大的一次全栈重构,几乎重做了安装、浏览器、记忆、模型、协作与安全九大模块。从架构演进、上手体验到竞品格局与安全边界,给出基于真实发布数据的现实判断:它更适合作为多通道个人与团队助手,而非编码工具。 产品概述 OpenClaw 是一个开源、本地优先(local-first)的个人 AI 助手 Gateway,目标是把模型、工具、记忆、消息渠道和本地执行能力连成一…- 1.3k
-
Mureka 评测:把“后期”也包进来的 AI 音乐平台,中文人声还是那道坎
给视频找段 BGM,翻素材库半小时,临了还得担心版权雷。Mureka 想解决的其实是后半段:生成只是起点,分轨、局部改词、导出 DAW 工程才是它真正下功夫的地方。这套模型在 Artificial Analysis 人声与器乐双榜都排到了第一,截至今年 8 月专业版 ¥68 一个月能给 500 首。但中文人声这道坎,劝你先自己听一遍再掏钱。 官网:https://www.mureka.cn/ | …- 1k
-
Hy4 preview 评测:770B 参数、1M 上下文,混元把旗舰价格又往下压了一档
让模型从一堆报销单里揪出哪张发票不合规,这种活儿过去得靠熟手干半天。腾讯混元今天放出来的新旗舰就是冲着这类脏活来的:770B 总参数、1M 上下文、输出 18 元/百万 tokens。参数堆得凶,价格压得低,真正要问的是它干活快不快、交付稳不稳。 产品概述 混元这次端出来的 Hy4 preview,是一代 MoE 旗舰的预览版本。总参数 770B,每个 token 只激活 49B,上下文长度拉到 …- 1.5k
-
Lovart 评测:全球首个 AI 设计智能体,真能当半个设计师用吗
做一张品牌海报还要在好几个工具之间反复横跳?Lovart 想把这整条链路塞进一个对话框里。它自称"全球首个 AI 设计智能体",一句话就能从 Logo 一路生成到视频和 3D 模型,还承诺跨版本风格统一。上手试下来,出图确实快、风格也稳,但细节编辑和客服响应仍带着明显的测试期味道。它值不值得你放弃一半设计外包,看这篇拆解。 产品概述 Lovart 在 2025 年 5 月上线,…- 1.5k
-
GLM-5.3-Flash 评测:用 Flash 的成本,摸到前沿模型的天花板
写代码还要为每次调用烧钱?GLM-5.3-Flash 把前沿模型的智能压到了 Flash 的价格。每次只激活 180 亿参数,API 价格做到旗舰的约一成,却能在编程基准上逼近 Claude Opus 4.8。它到底是不是低成本场景的默认选择,这篇评测给你答案。 产品概述 GLM-5.3-Flash 是智谱在 2026 年 8 月 26 日上线并开源的模型,编号 320B-A18B,是 GLM-5…- 1.2k
-
SenseNova U1.5 Lite 评测:8B 单卡跑出原生 4K 的开源多模态视觉模型
做一张带大段中文、又有精确版式的海报,开源模型往往卡在长指令理解这一步。SenseNova U1.5 Lite 想解决的就是这个:8B 参数量,单卡就能跑,原生支持 3 到 4k 字符的超长指令,还能直接出 4K 图。生成和编辑被压进同一个模型,不用在多个专家之间来回切。刚开源正式版,到底能不能扛起真实视觉交付,上手试了一轮。 产品概述 SenseNova U1.5 Lite 是商汤"日…- 1.1k
-
Codex Harness 评测:把 OpenAI 的智能体运行时拆开给你看
想把 OpenAI 的智能体跑在自己产品里,又不想从零写 agent loop?Codex Harness 把驱动 Codex 的整套运行时开源了,沙箱、审批、工具调用全交到你手上。 产品概述 Codex Harness 是 OpenAI 在 2026 年 8 月 19 日一篇平台文章里正式定名的那套东西:驱动 Codex App、Codex CLI 和 VS Code 插件的底层 agent 执…- 1.1k
-
从用户意图到三端原生界面:高德端云一体化的生成式 UI 实践
AI 大模型时代,人机交互正迎来一次深刻变革。传统“对话框 + 纯文本”的交互方式,已难以满足用户对 AI 体验的更高期待——用户期待的不只是一段回答,而是一个符合意图、可以交互的界面。基于大模型理解用户意图并动态生成交互界面的生成式 UI 技术,正推动 AI 从“直接给出答案”走向“提供可交互、可操作、可演进的界面体验”。 但生成式 UI 的规模化落地,必须同时回答两个基础问题:如何生成协议,以…- 1.4k
-
豆包工作评测:从问答助手到数字打工人
周报还要翻聊天记录磨两小时?让 AI 自己读文档、做表格、出 PPT,你只动嘴。豆包工作把"回答问题"升级成"交付结果",本地和云端双线跑,几十块一个月就能雇个不知疲倦的数字同事。 产品概述 豆包工作是字节跳动在豆包大模型之上推出的 AI 办公产品,定位很直白:从"问答助手"进化为能替你干活的"数字打工人"。它脱胎于 …- 1.5k
-
DeepSeek-V4-Flash-Vision-Exp 评测:DeepSeek 终于长出了眼睛
写 Agent 最怕什么?明明截图就摆在眼前,模型却看不见。DeepSeek 最近给纯文本的 V4 Flash 接上了视觉,一张图最多算 384 个 token,价格和文本版完全一样。它瞄准的不是聊天看图,而是让 Agent 真正能读截图、识图表、看报错。到底值不值得接,上手试一遍再说。 产品概述 DeepSeek-V4-Flash-Vision-Exp 是 DeepSeek 在 2026 年 8…- 1.1k
-
万相 Wan3.0 评测:文档直转 30 秒视频,阿里这次把”稳定”做成了卖点
做个产品演示视频还得搭摄影棚、排拍摄?万相的最新视频模型直接把文档和参考图变成 30 秒成片,主打"稳定、真实、有质感"。今天上线的它把单次生成拉到 30 秒,还首次吃进了 PPT 和 PDF。我把它和几个主流模型摆在一起,看它能不能真的进生产流程。 产品概述 万相 Wan3.0 是阿里巴巴的视频生成大模型,2026 年 8 月 24 日正式上线。此前的公测从 8 月 6 日启…- 1.3k
-
OnSolo 评测:腾讯”一个人就是剧组”的 AI 短剧平台,究竟能拍出什么?
想拍短剧却凑不齐编剧、演员、剪辑的团队?腾讯 2026 年 8 月上线的 OnSolo,把整条影视生产链压进一个浏览器页面,输入一句话就能产出剧本、分镜、素材到成片。它最狠的杀招是零代码的 FMV 互动影游,市面上几乎没有同款。但英文界面、境外访问不稳、免费额度吝啬这三道坎,让国内用户得掂量掂量。 产品概述 OnSolo 是腾讯推出的 AI 原生影视创作平台,8 月 15 日正式上线,前身是内测产…- 1k



































