Anthropic老板说担心中国AI,但开源模型真该被限制吗?
一个开源模型凭什么收费比闭源还贵? 上周Anthropic的Dario Amodei又出来说话了,这次他针对开源模型和中国AI能力发表了一通看法。大意是:我们不反对开源,但得小心中国AI的崛起
一个开源模型凭什么收费比闭源还贵?
上周Anthropic的Dario Amodei又出来说话了,这次他针对开源模型和中国AI能力发表了一通看法。大意是:我们不反对开源,但得小心中国AI的崛起。这话一出,技术圈直接炸了。我第一反应是:一个靠闭源模型赚钱的公司,突然对开源指手画脚,这背后到底藏着什么算盘?
开源模型和闭源模型的战争,从来不只是技术路线之争,更是地缘政治的角力。
事件:Amodei到底说了什么
在最近一次采访中,Dario Amodei明确表示,Anthropic不反对开源模型本身,但担心中国AI能力的快速提升会带来安全风险。他特别强调,开源模型如果被“某些国家”拿去滥用,可能会加速危险能力的扩散。这话说得挺委婉,但谁都知道他在指谁。
有个细节很有意思:Amodei提到他们内部做过评估,认为中国在AI领域的追赶速度比外界想象的要快得多。根据公开数据,中国在AI论文数量和专利数量上已经接近甚至超过美国,但在基础模型能力上还有差距。不过这个差距正在以每年20%-30%的速度缩小。
技术上来说,开源模型和闭源模型的区别在于权重是否公开。像Meta的Llama系列就是开源权重,任何人都能下载微调;而Anthropic的Claude和OpenAI的GPT-4则是闭源,只能通过API调用。Amodei担心的是,一旦开源模型的能力达到某个临界点,被恶意使用的风险会指数级上升。
为什么重要:开源模型动了谁的蛋糕
Amodei这番话,表面上是安全担忧,实际上是在给开源模型套上“地缘政治”的枷锁。我直接说我的判断:闭源厂商最怕的不是开源模型技术不行,而是开源模型太强,强到能免费复现闭源80%的能力。
举个例子,去年Meta开源的Llama 3 70B,在多项基准测试上已经逼近GPT-4的水平,而它完全免费。这对Anthropic和OpenAI来说,简直是釜底抽薪。毕竟,Claude 3.5 Sonnet的API调用价格是每百万token 3美元,而一个部署在自有服务器上的Llama 3,成本几乎可以忽略。
开源模型让“AI民主化”从口号变成了现实,但也让闭源厂商的护城河瞬间变浅。
从行业影响来看,如果开源模型真的因为“安全原因”被限制,最大的受益者是谁?毫无疑问是闭源巨头。他们可以继续维持高价API,同时用合规和安全作为壁垒,把竞争者挡在门外。这就像当年微软一边高喊“开源是毒瘤”,一边悄悄拥抱Linux一样。
对谁影响最大:开发者、创业公司、还是普通用户?
先说开发者。我身边很多AI应用开发者,现在都倾向于用开源模型做二次开发。因为闭源API有三大痛点:价格贵、数据隐私风险、以及随时可能被断供。比如你辛辛苦苦用GPT-4 API做了一款产品,结果OpenAI突然改定价策略,你的商业模式直接崩盘。而开源模型,只要你有一张A100显卡,就能本地部署,完全可控。
对创业公司来说,开源模型更是救命稻草。我认识一个做AI客服的小团队,他们用Llama 3微调后,效果比用GPT-3.5好,成本却只有后者的十分之一。如果开源模型被限制,他们要么被迫用高价闭源API,要么自己从零训练模型——后者对于小团队来说基本不可能。
对普通用户呢?你可能觉得离自己很远。但想想看,你用的很多AI工具,比如一些免费的ChatGPT替代品,背后很可能就是开源模型。如果开源生态被压制,这些工具要么涨价,要么消失。最终买单的还是消费者。
开源模型不是技术问题,而是权力问题——谁掌握AI的“生产工具”,谁就能制定规则。
深层原因:中美AI竞赛下的安全叙事
Amodei的担忧并非空穴来风。根据斯坦福的AI指数报告,2023年中国在AI领域的私人投资虽然只有美国的六分之一,但政府投入和论文产出却非常惊人。更关键的是,中国企业在应用层面走得很快,比如字节跳动的豆包、百度的文心一言,用户量都在千万级别。
但问题在于,把开源模型和安全问题绑定,本身就是一个危险的前提。开源模型的本质是透明,任何人都能审查代码和权重,反而更容易发现漏洞。而闭源模型的黑箱,你根本不知道它内部有没有后门。OpenAI的Sam Altman曾经说过:“开源模型的安全风险是存在的,但闭源模型的权力集中风险更大。”
我个人的第二个判断是:Amodei的言论更像是一种公关策略,目的是为Anthropic争取更多的监管话语权。 毕竟,如果美国政府真的出台限制开源模型的政策,Anthropic作为“负责任”的闭源厂商,反而能获得政策红利。
从技术原理上说,开源模型和闭源模型在安全性上的差异,其实没有想象中那么大。一个开源模型被恶意微调,和一个闭源模型被越狱攻击,本质上都是安全问题。只不过开源模型让攻击的门槛更低,但同时也让防御的门槛更低——因为白帽黑客也能拿到权重进行安全测试。
实际场景:我用开源模型做了个什么
聊点实际的。上个月我用Meta的Llama 3 70B微调了一个中医问答助手,专门回答养生问题。整个过程用了大概一周,花费不到500元(主要是租用云GPU的费用)。如果用Claude的API做同样的事,一个月光API费用就要3000元以上,而且数据还得上传到Anthropic的服务器。
这个例子说明,开源模型让个人和小团队也能参与到AI创新中。如果因为地缘政治原因限制开源,那么像中医助手这种小众但有用的应用,可能永远不会出现。
还是留个悬念吧
Amodei的话里其实还藏了一层意思:他提到了“某些能力”的开源需要特别谨慎。具体是哪些能力?他没有明说。我猜可能是多模态或者代码生成相关的权重。不过有个隐藏的细节他们没公开说,我还在测,回头单独写一篇。
本文基于 media 公开报道编译解读
本文基于 media 公开报道编译解读,查看原文