-
字节内测“漫剧创作工具”:搭载豆包大模型,支持20万字剧本上传
《读佳》获知,字节正在内测一款漫剧创作产品,名字就叫“漫剧创作工具”,Slogan“让创作更纯粹”,搭载豆包多个大模型。 该产品是字节专门针对漫剧赛道,面向内容创作者与内容公司打造的AIGC创作平台,支持从剧本上传、项目规划、剧本策划、资产设计、分镜生产到视频合成的完整创作流程,让创作者更高效地完成漫剧内容生产。此外,也可以绑定抖音短剧创作者中心账号,绑定后即可开启跨端数据互通。 当前工具处于内测…- 1.2k
- 0
-
Agent的上限,可能不在模型,而在团队知识
当 Agent 成为团队一线生产力,知识供给的问题随之暴露:检索不准、注入低效、过时内容越堆越多。本文记录安全中心团队从定目标、搭体系到跑通知识飞轮的完整过程,包括关键决策背后的思考、踩过的坑,以及可直接复用的方法。当团队开始用 Agent 做研发和运营,一个问题很快浮出来:Agent 的输出质量,直接取决于你能给它什么质量的知识。怎么让知识「产得出、找得准、喂得进、淘汰得掉」,是每个上了 Age…- 1.2k
- 0
-
Qwen-Audio-3.0系列语音模型正式上线千问AI平台
刚刚,Qwen-Audio-3.0系列语音模型正式上线千问AI平台。开发者可以通过API服务调用模型能力,也可以订阅Token Plan使用。 Qwen-Audio-3.0系列模型是阿里巴巴推出的自研语音模型,包括语音识别大模型Qwen-Audio-3.0-ASR、语音合成大模型Qwen-Audio-3.0-TTS、实时语音交互对话模型Qwen-Audio-3.0-Realtime。 在全球权威A…- 1.2k
- 0
-
说一个反常识的真相,Agent如今在真实工作场景的成功率依然很低。
上周一,我发了自己做的AIHOT大模型排行榜。 有很多朋友感兴趣,在文章下面评论,最高赞的一条,是在问能不能有个分类测评,能够评估不同模型做不同任务的表现。 讲道理,这其实一直是我想做的,也是我觉得特别特别核心的痛点。 现在的大模型榜单很多,比如LiveBench、DeepSWE之类的,可以很快知道哪个模型在某一个能力维度上更强,像Coding、数学、浏览器操作等等。 但是有一类评测集,其实是最稀…- 1.2k
- 0
-
阿里打造新“虾米”,推出AI音乐平台“Happy Shrimp”
我们很好奇:AI音乐,能否改写版权为王的竞争规则? 《读佳》获知,阿里ATH事业群已推出AI音乐平台“Happy Shrimp”,Slogan是“Hear Your Imagination(让想象,成为音乐)”,海外版也同步上线。 简单而言,这是一个结合了AI音乐创作和音乐播放功能的AI产品,可通过一句话生成专属歌曲,俨然一个AI版“虾米”,此外,我们还了解到,“快乐虾米”App也即将在国内上线,…- 1k
- 1
-
林俊旸官宣Pragmatik Labs:不做大模型续集,去造横跨「数字与物理」的下一代Agent
一家估值一度被传到 20 亿美元、却始终没有正式名字的 AI 公司,终于露出了全貌。 8 月 12 日,原阿里千问技术负责人林俊旸宣布在上海创立 Pragmatik Labs,中文主体为语用科技,内部简称 p7k。公司将研究「横跨数字世界与物理世界的下一代 Agent」。高榕创投与红杉中国联合领投,腾讯和上海未来产业基金参与支持。 Pragmatik 的官网仍然克制。没有模型参数,没有产品演示,也…- 1.5k
- 0
-
AI Infra入门干货总结:大模型是如何高效推理的
作者:binnnliu 看了很多的文章和视频,我以为我理解大模型的工作原理了,直到看了vLLM的代码,我发现很多地方理解的太过表面。因此花了大概2个月的业余时间,深入阅读了vLLM的源码,本文算是对于学习代码的一个总结。另外由于当前主流LLM都是 Decoder-Only 架构,本文会聚焦LLM,不会像网络上其他介绍Transformers的文章从原始论文的 Encoder-Decoder架构讲起…- 1.8k
- 0
-
万字解读 Avi Chawla《2026 LLM工程师路线图》,8 层能力框架看 AI 应用工程
大家都非常关注一个话题:在 AI 热潮越来越猛的今天,普通人到底该怎么进入 AI 行业? 如果你最近也在焦虑、在内耗,不知道该学什么、不知道该怎么开始,这篇文章应该会对你有帮助。 最近我看到 Avi Chawla 发了一篇文章,叫:《The 2026 LLM Engineering Roadmap》,翻译过来就是: 2026 LLM 工程师路线图 简单介绍: Avi Chawla 可以理解为一个 …- 1.9k
- 0
-
Qwen3.6-Max-Preview来了!
继 Qwen3.6-Plus 发布之后,我们分享下一代旗舰模型的早期预览版:Qwen3.6-Max-Preview。相比 Qwen3.6-Plus,本次预览版带来了更强的世界知识和指令遵循能力,以及在多项基准上显著提升的智能体编程表现。作为预览版,模型仍在积极迭代中,后续版本将持续优化。 Qwen3.6-Max-Preview主要特性包括: 相比 Qwen3.6-Plus 显著提升的智能体编程能力…- 1k
- 0
-
Transformer:让AI学会”一目十行”的神秘架构
你知道吗? 2017年,Google发了一篇论文,名字叫《Attention is All You Need》。这篇论文的八位作者,后来走出了六家AI公司——OpenAI、Character AI、Cohere……整个大模型时代的半壁江山,都跟这篇论文有关。 而这篇论文的核心,就是 Transformer。 一句话理解 Transformer = 让AI能够"同时看到"一句话里…- 1.2k
- 0
-
千问发布新一代大语言模型Qwen3.6-Plus
今天,千问发布新一代大语言模型Qwen3.6-Plus。 千问3.6整体性能较3.5进步显著,涌现出极强的智能体编程能力,在系列编程能力权威评测中,千问3.6成为当下编程能力最强的国产模型,接近全球最强编程模型 Claude 系列。 在前端网页开发、仓库级复杂任务等实测场景中,千问3.6可自主拆解任务、规划路径、测试修改直至任务完成。Qwen3.6-Plus 展现出卓越的工程落地能力,不仅…- 1k
- 0
-
Grok 深度评测:马斯克的AI野心,值得你花 $30/月吗?
摘要: Grok 是 X AI 推出的 AI 助手,深度绑定 X 平台实时数据,支持 2M 超长上下文、多模态输入及 Big Brain 深度推理。免费版每2小时10次,SuperGrok $30/月无限使用。最适合重度 X 用户和需要实时信息的内容创作者。 最近我一直在观察一个问题:为什么 Grok 这个产品,会让很多人同时觉得"很厉害"又觉得"用不上"?…- 786
- 0
-
AI概念手册(人话版):大模型、智能体、Skill。。。这些都是啥?
家人们,AI圈新词爆炸,大模型、智能体、RAG、工作流……是不是光看这些词脑袋就嗡嗡的? 作为老板,其实不需要全懂,盯紧一个“智能体”,就能把AI落到业务里。今天就用“招员工”的类比,给你讲透所有AI概念,以及怎么让AI真正为你赚钱。 如今AI领域的新词层出不穷,大模型、智能体、RAG、工作流……一个个专业术语光是想搞懂概念就需要费老大劲了,如果搞不明白,又担心自己跟不上节奏。 其实,作为企业经营…- 396
- 0
-
Xiaomi Mimo系列综合场景深度测评报告
Mimo-v2-Pro & Mimo-v2-Omni 综合场景深度测评报告 数据来源:XSCT Arena | 评测日期:2026-03-19 用例集:16 条跨模型对比(L/W/A 三维覆盖)+ 14 条小米内部对比 基于 XSCT Arena 平台 L(文本理解)/ W(Web 应用生成)/ A(Agentic 任务)三轨全量数据,对标 Mimo-v2-Flash 内部基线,横向比…- 519
- 0
-
在大模型这件事上,雷军居然给马斯克打样了
14亿月活用户的庞大基数,让微信任何细微更新都可能被放大审视:灰度测试导致"新功能在哪儿"的困惑,众口难调使得"好用"与"极简"难以平衡,用户习惯被改变后的不适感,以及"改了跟没改区别不大"的隔靴搔痒感。 ———— / BEGIN / ———— 在小米正式发布了MiMo-V2-Pro大模型以后,第一个出现在我脑子里的人…- 888
- 0
-
AI日报:Cloudflare预警,2年后,互联网上的AI比人还多!
下午好!我是老曹。今天刷了一圈AI圈的消息,发现AI编程工具这块儿又有新动静了。Claude出了个HUD插件,能让开发者实时看到AI在干嘛,这点挺实用的。另外具身智能那边也挺热闹,中国机器人销量涨了13%,看来春晚那波宣传真起作用了。还有贝索斯那个1000亿美元的大计划,以及Cloudflare说2027年AI流量要超过人类,都挺让人惊讶的。总的来说,今天值得关注的点还不少,往下看详情吧。 🔷 A…- 1k
- 0
-
一场没有硝烟的战争,重新定义AI竞争的本质
2026年3月上旬,一枚炸弹在AI圈炸响。 Anthropic,Claude的母公司,在官网发布报告《检测并防御蒸馏攻击》,公开点名三家中国AI独角兽: DeepSeek、月之暗面(Kimi)、MiniMax。 指控内容触目惊心:这三家公司通过约2.4万个伪造马甲账号,与Claude产生了超过1600万次系统性交互,工业规模地"抽取"Claude的核心能力,用于训练自己的模型。…- 694
- 0
-
AI日报: 中国AI力量集中爆发,小米大模型入局、Token调用量反超美国、具身智能国标发布
🔷 AI Coding 领域 1. 小米深夜发布三大自研MiMo-V2系列模型 时间:2026年3月19日 | 来源:IT早报 / 财联社内容:小米上线MiMo-V2系列三大模型:旗舰Pro版(专为高强度Agent工作场景打造,超1T总参数量、42B激活参数)、全模态基座Omni版、语音合成TTS版。已登陆小米MiMo Studio、金山办公、小米浏览器,并通过OpenClaw等接口限时免费体验一…- 376
- 0
-
MiniMax-M2.7 深度测评报告
数据来源:XSCT Arena(xsct.ai) 报告日期:2026 年 3 月 18 日 本推文由 xsct.ai 自动化生成并发布。 完整版点击「查看原文」阅读。 一、执行摘要 MiniMax-M2.7 是 MiniMax 旗舰文本模型,XSCT Arena xsct-l 综合得分 84.5,全场第 #11,位于第二梯队头部。其最显著的特征是「文字强但推理弱」——在润色、摘要等文字生成任务中超…- 13
- 0
































