← 返回每日热点
BiFish original · 2026-09-14

OpenAI那个'太危险'的模型,六年后看不过是营销前戏

OpenAI 造出强大文本生成器,却因太危险而不敢发布。 看到这条六年前的新闻,我忍不住笑出声。这剧情太熟悉了,像极了好莱坞预告片里'本片根据真实事件改编'的套路——先给你一个震撼的声明,然后让你等

OpenAI 造出强大文本生成器,却因太危险而不敢发布。

看到这条六年前的新闻,我忍不住笑出声。这剧情太熟悉了,像极了好莱坞预告片里'本片根据真实事件改编'的套路——先给你一个震撼的声明,然后让你等。

01

危险叙事

2019年2月,OpenAI宣布他们训练了一个叫GPT-2的模型,能生成以假乱真的文本,但因为'太危险'而决定不公开完整版本。他们只放出了一个1.17亿参数的缩小版,完整版据称有15亿参数。当时媒体炸了锅,伦理学家开始讨论,Hacker News上也吵翻了天。

但这里有个问题。

GPT-2真的是因为'危险'而被封存的吗?

看看时间线就明白了。2019年是AI商业化前夜,谷歌的BERT刚发布几个月,Transformer架构还在圈内消化。OpenAI需要一个能让自己出圈的事件。'我们造出了太厉害的东西,不敢给你看',这个叙事完美击中了公众的恐惧和好奇心。

这不是安全决策,这是传播策略。

上一轮类似的事发生在DeepMind的AlphaGo。2016年击败李世石后,DeepMind反复强调AI的'通用性'和'潜在风险',这套话术直接帮他们拿到了谷歌的持续输血。恐惧是最好的融资工具。

OpenAI那个'太危险'的模型,六年后看不过是营销前戏(GPT-2)
02

数据拆解

把GPT-2放到2019年的技术坐标系里看。15亿参数,在当时确实是个大数字。但要知道,2020年的GPT-3就有1750亿参数,而到了2025年的今天,主流模型动辄万亿级别。GPT-2的参数量放在现在,连一个中等规模的开源模型都不如。

性能方面,GPT-2在当时的标准测试集上确实表现不错,能生成连贯的新闻段落、续写小说。但它的幻觉问题严重,生成内容的事实错误率很高。用今天的标准衡量,它大概介于一个还不错的语言玩具和一个能用的工具之间。

跟同期的竞争对手比呢?2019年谷歌的BERT在理解任务上已经很强,但生成能力一般;Facebook的RoBERTa还在路上。GPT-2的真正优势是单向生成——它从左到右预测下一个token,这种架构天然适合写文章、编故事。但这个优势并不是不可替代的。

数据背后说明一件事:OpenAI当时的技术领先并没有他们宣传的那么大。

03

行业影响

GPT-2的'危险发布'事件,对整个AI行业产生了两个深远影响。

第一,它开创了'安全营销'的范式。后来我们看到,几乎每家大模型公司都会在发布时强调'我们对齐了'、'我们做了安全测试'、'我们限制了某些能力'。这些声明未必是假的,但它们同时也是一种市场定位——'我们很强大,但我们也负责任'。这种双重叙事让AI公司同时收割了技术光环和道德高地。

第二,它加速了AI监管的讨论。GPT-2事件后,欧盟、美国国会都开始关注AI生成内容的风险。虽然真正的监管落地还要等到几年后,但OpenAI的这次'表演'确实把议题提前推到了公众面前。讽刺的是,OpenAI后来自己成了最大的'不负责任'案例——从GPT-3的API开放策略到ChatGPT的激进推广,他们早就不提'危险'了。

竞争对手的反应也很有意思。谷歌在GPT-2事件后加速了自己的语言模型研发,但策略完全不同——他们选择低调迭代,不搞'不敢发布'的戏码。Meta则走了开源路线,用Llama系列直接把模型扔出去。这两种策略都比OpenAI的'安全营销'更诚实,但传播效果都差了一截。

OpenAI那个'太危险'的模型,六年后看不过是营销前戏(GPT-2)
04

普通人怎么看

如果你是AI从业者,或者只是关注这个行业的普通人,这件事跟你有什么关系?

关系大了。GPT-2事件教会我们一件事:不要被AI公司的'能力声明'吓到。 每次有人告诉你'这个模型太强大了',你都应该问一句:强大在哪?跟谁比?在什么场景下?

举个实际例子。2019年,如果你真的拿到了GPT-2的完整版,你会发现它能做的就是生成一些看起来像新闻的文字。但这些文字没有事实核查,没有信息来源,没有逻辑自洽性。用它写一篇关于某个公司的报道,你大概率会得到一篇充满虚构细节的文章。这在当时确实有风险——如果你把它当真的话。

但这种风险在今天依然存在,而且更严重。GPT-4、Claude、Gemini这些模型的生成能力比GPT-2强了几个数量级,它们生成的内容足以欺骗大多数人。讽刺的是,OpenAI现在是制造这种风险的最大玩家之一,却很少再提'危险'了。

所以我的判断是:GPT-2的'危险声明'从一开始就是一场精心设计的营销。它达到了目的——让OpenAI从一家研究机构变成了公众关注的焦点。但它的技术意义被严重高估了。

05

结论

六年后回头看,GPT-2不过是一个中等规模的语言模型,被包装成了一个'不敢发布'的怪物。这套路现在还在用,只是换了个名字——'AGI'、'ASI'、'超级智能'。每次你听到这些词,都应该想起2019年那个'太危险'的模型。

现阶段值得警惕的不是模型的能力,而是AI公司的话术。

本文基于 developer 公开报道编译解读,查看原文

公开来源
  1. OpenAI 造出强大文本生成器,却因太危险而不敢发布