国华的世界

这是国华对读过的书, 看过的电视/电影, 听过的音乐, 访游过的地方, 经历过的事物, 和时事的感想或点评.
个人资料
国华P (热门博主)
  • 博客访问:  
正文

审时度势

(2026-07-27 08:55:37) 下一个

自从Anthropic首席执行官阿莫迪(Dario Amodei)等硅谷顶尖AI企业负责人公开呼吁美国政府加强对中国开源大模型的监管之后,这一主张也迅速获得了川普政府部分官员的响应。然而,硅谷并非只有一种声音。包括著名创业孵化器Y Combinator在内的近200家科技企业近日联名致信川普总统,敦促政府不要对中国开源大模型采取"一刀切"式的限制措施。他们担心,这种做法不仅难以遏制中国AI的发展,反而可能削弱美国企业自身的竞争力。这种担忧并非空穴来风。八年前,美国对华为实施前所未有的制裁,希望借此切断其获取关键技术和零部件的渠道。然而,华为不仅没有因此退出市场,反而加快了自主生态建设,如今与苹果(手机)、英伟达(芯片)、微软(操作系统)等美国科技巨头展开正面竞争。

类似的一幕也出现在人工智能领域。近年来,美国一方面禁止向中国出口先进GPU芯片,另一方面又限制中国企业获取美国最先进的闭源大模型。本意是延缓中国AI的发展,却客观上刺激了中国本土创新。月之暗面的Kimi K3、智谱AI的GLM-5.2等中国大模型相继崛起,并在多个国际基准测试中展现出接近国际领先水平的能力。值得一提的是,GLM-5.2甚至协助开源AI平台Hugging Face分析并定位了入侵闯祸的熊孩子,为安全调查提供了重要支持。

事实上,早在一年半前DeepSeek发布R1模型时,便已有不少业内人士撰文指出,单纯依靠"封堵"中国AI并非长久之计。他们认为,与其试图限制竞争对手的发展,美国政府更应审时度势,顺应技术开放与全球创新的新趋势,把政策重点放在增强美国企业自身的创新能力和市场竞争力,以更强大的技术实力、更完善的产业生态和更快的创新速度,与中国展开长期竞争。笔者认为今天重读该篇题为《How the US may have unintentionally helped create an AI monster in China》的文章颇有意义,文章原文发表在2025年1月27日的《商业内幕》网站。兹将该文主要内容翻译如下。

美国助力中国人工智能 

多年来,美国政府一直积极试图限制中国获取半导体芯片,而半导体芯片是生成式人工智能模型的关键组成部分。然而,这些出口限制反而可能推动了创新,最终催生了DeepSeek的R1-一个大型语言模型,它正在颠覆美国的人工智能产业及其赖以生存的蓬勃发展的经济。晨星公司科技分析师布莱恩·科莱洛表示,他想到了“限制激发创造力”(constraints lead to creativity)这句名言。“这些中国模型受到处理器的限制,因此在训练过程中出现了一些创造性的技术,而考虑到训练所用的处理器,DeepSeek 模型已经取得了超出预期的性能,” 他告诉 Business Insider。

DeepSeek颠覆性创新

上周,中国人工智能初创公司DeepSeek发布了一款基于其R1模型的应用程序。该模型几乎可以与Meta、 OpenAI和谷歌等美国大型科技公司的模型相媲美,但成本却低得多。这家中国公司表示,它只花费了不到 600万美元用于计算能力训练其新系统,仅及美国科技公司在其模型上花费的一小部分。DeepSeek表示,其模型使用的半导体芯片数量更少,性能也比竞争对手使用的芯片要低。

自2022年起,美国制裁措施禁止英伟达向中国出售人工智能芯片,以限制中国在人工智能和军事技术领域的进步。“制裁迫使 DeepSeek 使用 H800,其性能不如 H100,” Moor Insights & Strategy 的首席执行官穆尔黑德(Patrick Moorhead) 在谈到 DeepSeek 使用的英伟达芯片时告诉《商业内幕》记者。他补充道:“从某种意义上说,拜登政府发起的制裁促使DeepSeek在模型训练和运行方面更具创新性。这并不令人意外,因为 ‘需要是发明之母’”(Necessity is the mother of invention)嘛。

受到制裁的人工智能初创公司DeepSeek,其成功道路与中国科技巨头华为的经历如出一辙。尽管失去了获取先进 芯片的渠道,华为仍持续推出了一系列智能手机。令美国决策者大为震惊的是,这些新推出的手机 大多采用国产硬件 和软件,从而取代了西方技术。

培训和计算成

一些接受商业内幕(BUSINESS INSIDER)采访的专家和分析师对 DeepSeek 关于模型成本以及构建模型所用芯片的数量和类型的说法表示怀疑。目前尚不清楚 DeepSeek 究竟使用了哪些半导体来训练和部署模型。不过,一些 分析师表示,这家初创公司表明,在人工智能领域,可以用更少的资源做更多的事情。德意志银行分析师 Adrian Cox 和 Galina Pozdnyakova 在周一发布的一份研究报告中写道,DeepSeek 不得不从其软件和方法(例如思维链推理和同时使用多个模型)中榨取更多价值,而不是仅仅投入更多算力来解决问题。

2022 年出版的《芯片战》一书的作者克里斯·米勒告诉 BI,DeepSeek 的模型令人印象深刻。但自 2023 年以来,人工智能的成本已经大幅下降,因此他并不觉得该公司的 R1 研究论文特别令人惊讶。他还补充说,DeepSeek“预算捉襟见肘”的说法并不属实,并指出该公司对培训成本的定义“非常狭隘”。米勒表示,“很明显,培训成本比DeepSeek所声称的要高出一个数量级”。

限制无效

Scale AI首席执行官亚历山大·王周日在接受CNBC采访时表示,DeepSeek拥有5万台H800服务器,米勒称这是一个“相当大的数字”。米勒表示,虽然这个数字远低于美国公司拥有的数量,但可能远远超过了美国出口官员希望任何一家中国公司拥有的数量。美国外交关系委员会中国研究高级研究员刘宗媛告诉BI,DeepSeek的发展表明,中国的人工智能发展“似乎至少与美国不相上下”。

但她表示,“我们仍处于人工智能主导地位竞赛的初期阶段”。她补充说:“这无疑提醒了美国政策制定者,技术限制可能行不通,这取决于最终目标是什么。”多位专家表示,他们认为DeepSeek的最新进展可能会导致对中国半导体行业的更多制裁,但这不一定会阻止进一步的创新。科莱洛说:“美国可以整天对中国实施制裁,但总存在这样的威胁:如果中国最终取得一些突破怎么办?”

参考资料

Vlamis, K & Ortiz, K.(2025). How the US may have unintentionally helped create an AI monster in China. BUSINESS INSIDER. 链接 https://www.businessinsider.com/china-deepseek-chip-restrictions-exports-imports-2025-1#:~:text=The%20US%20tried%20to%20limit,more%20efficient%20computing%20at%20scale.

[ 打印 ]
阅读 ( )评论
评论
目前还没有任何评论
登录后才可评论.