OpenAI 的 Sam Altman 四处筹措万亿美金建设算力基础设施,各家实验室军备竞赛般地烧钱烧卡,底层假设只有一个:模型越大,就越聪明 … Qwen 3.5 Small 系列中,9B 参数的模型在多项基准测试中全面超越了 OpenAI 的 gpt-oss-120B—— 一个参数量是它 13 倍的模型 … 大模型的路线是「尽可能多地吞入互联网数据」,而小模型路线的代表 —— 比如微软的 Phi-4 系列 —— 走的是精筛路线:用高质量的合成数据加上严格筛选的公开数据集,让模型在更少的数据上学到更精确的能力。
暂无讨论,说说你的看法吧

