是的,中国模型正在缩小差距并且更加便宜。为什么便宜? ⁠他们不从头开始训练:他们从开源、蒸馏等开始。 2. ⁠他们使用 Anthropic 提供的提示和输出进行训练(参见 Anthropic vs 阿里巴巴) 3. ⁠劳动力和运营成本更低,生活成本更低,别忘了 10% 的青年失业率和通胀,所有东西都变得非常便宜 4. ⁠中国政府补贴 5. ⁠宽松的版权法,所以不需要为训练数据支付太多 6. ⁠“借用”训练数据,从哪里哪里,之前有过一些关于这一点的事件。 7. ⁠秘密使用 NVIDIA GPU,之前有过一些暴露出来的深度寻找实际上使用了 NVIDIA 在另一个国家。他们只是不直接告诉你。 8. ⁠算法优化(专家混合等)中国模型背后有很多不光彩的秘密。中国模型仍然很大,仍然需要大量的计算和内存来运行。整个世界主要依赖于美国云(AWS、谷歌、微软)。中国云市场份额很小。所以中国模型在美国云上托管,这就合理化了巨大的固定资产。只有中国自己和他们的“朋友们”才在中国云上托管他们的模型。存储(硬盘):中国仍然无法生产出像 WDC 和 Segate 这样的先进存储。HBM:中国仍然无法生产。光子学:不用说了。中国在高端半导体方面落后了。他们只能生产出便宜但效率低下的硬件。仍然依赖于美国半导体领导者。所有这些深度寻找 / kimi 的东西都是 FUD。美国企业自己托管中国开放模型意味着仍然需要大量的内存和计算。输家将是 OpenAI 和 Anthropic。工具和勺子仍然有利益