lulupedia

OpenAI

4827 words·2026/9/22·中文
44

OpenAI(开放人工智能公司)是一家总部位于美国加利福尼亚州旧金山的人工智能研究与发展公司。该公司成立于2015年12月,最初为非营利研究实验室,宣称的使命是确保人工通用智能(AGI)——即设想中能够匹配或超越人类能力的智能系统——造福全人类。OpenAI以研发生成式预训练变换器(GPT)系列大型语言模型、文生图系统DALL·E以及对话式人工智能ChatGPT而闻名,其中2022年11月发布的ChatGPT被广泛视为引发全球生成式人工智能热潮的标志性产品。随着发展,公司逐步由纯非营利机构演变为“非营利母公司+封顶营利子公司”的混合结构,其后又推动营利部门向公共利益公司转型,并与微软建立了深度的投资、算力与产品合作关系。截至2020年代中期,OpenAI已成为全球人工智能行业最具影响力的机构之一。

背景

OpenAI的诞生与2010年代人工智能技术的快速进步密切相关。依托图形处理器(GPU)算力的提升和大规模数据集的积累,深度学习方法在图像识别、语音处理和博弈等领域接连取得突破。谷歌旗下的DeepMind与Facebook人工智能研究(FAIR)等机构取得的成果,既激发了公众对人工智能前景的期待,也引发了对技术发展失控风险的担忧。

在此背景下,一批技术专家和企业家于2015年共同发起创立了OpenAI,其中包括时任特斯拉和SpaceX首席执行官的埃隆·马斯克、时任创业孵化器Y Combinator总裁的萨姆·奥尔特曼(Sam Altman)、前Stripe高管格雷格·布罗克曼(Greg Brockman)、来自谷歌大脑的知名深度学习研究者伊利亚·苏茨克维(Ilya Sutskever),以及沃伊切赫·扎雷姆巴(Wojciech Zaremba)和约翰·舒尔曼(John Schulman)等人;彼得·蒂尔(Peter Thiel)、里德·霍夫曼(Reid Hoffman)、杰西卡·利文斯顿(Jessica Livingston)等提供了早期支持,创立时承诺投入的资金总额为10亿美元。

创始人的核心动机可归纳为两点。其一,他们担心先进的人工智能若仅由少数资金雄厚的公司或政府在缺乏安全考量的情况下开发,可能带来生存层面的风险。其二,他们认为当时已知的构建安全人工智能的最有效路径——在大规模数据上训练大型系统——需要与顶尖私营实验室相当的资金和人才规模,而这样的实验室理应以面向公共利益、并尽可能开放的非营利形式运作。"OpenAI"这一名称即体现了其早期承诺公开发表研究成果、与公众共享专利和代码的立场。

历史沿革

创立与早期研究(2015—2018)

成立之初,OpenAI作为非营利研究实验室运作,陆续发布学术论文,并推出强化学习研究工具包Gym、用于跨软件环境评估智能体能力的平台Universe等工具。实验室招募了多位知名研究者,研究方向涵盖机器人、强化学习和语言建模。2018年,团队构建了在复杂电子游戏《Dota 2》中与职业选手对抗的系统OpenAI Five,以及通过仿真训练操控实体物品的机械手Dactyl。同年2月,马斯克退出董事会,其表述的原因是避免与特斯拉的人工智能研发产生利益冲突,此后一段时间内他仍为捐赠者。2018年,OpenAI还发布了GPT-1,开启了其影响深远的大型语言模型系列。

结构重组与微软合作(2019—2021)

2019年,OpenAI宣布其结论为:训练规模日益庞大的AI系统所需的资本远超非营利机构的筹款能力,为此设立了“封顶盈利”子公司OpenAI LP(后更名为OpenAI Global, LLC),投资者和员工的回报被限定为投资额的一定倍数(最初为100倍),超出部分利润归属非营利母公司。同年,微软向公司投资10亿美元,并成为其独家云计算服务提供商。2020年,OpenAI将GPT-3授权给微软,后者将其整合进商业产品。

在此期间,OpenAI分阶段发布GPT-2:最初以担心滥用为由未公开完整模型,这一决定引发了关于人工智能成果发布规范的重大争论,直至2019年11月才完整开放。2021年,公司发布了根据文字描述生成图像的系统DALL·E,以及驱动GitHub Copilot的代码生成模型Codex。

ChatGPT时代(2022—2023)

2022年,OpenAI先后推出DALL·E 2和语音识别系统Whisper。2022年11月30日,公司发布了基于GPT-3.5的对话式产品ChatGPT,成为其发展史上的转折点。该聊天机器人据估计在两个月内即获得约1亿用户,创下当时消费级应用增长速度的纪录,并促使公众和商业界大规模关注生成式人工智能。2023年初,微软扩大投资,据报道承诺投入约100亿美元,并将OpenAI的模型整合进其多条产品线。2023年3月,OpenAI发布多模态模型GPT-4,其推理能力和在专业考试中的表现较前代显著提升。同年晚些时候,公司推出允许用户构建自定义聊天机器人的GPTs功能,并在后续模型中预演了更为先进的“推理”能力。

领导层危机(2023年11月)

2023年11月,OpenAI非营利董事会突然解除奥尔特曼的首席执行官职务,理由是其在沟通中“并非始终坦诚”;布罗克曼随后辞职以示声援。此举引发了持续五天的公司动荡:数百名员工联名致信,威胁若不恢复奥尔特曼职务并改组董事会将集体离职。在微软参与斡旋(其间微软表态愿意聘用出走团队)之后,奥尔特曼复职,董事会改组并由布雷特·泰勒(Bret Taylor)出任主席。该事件使前沿人工智能实验室的治理结构、商业化与安全优先级之间的张力,以及对强大人工智能系统影响力的集中等问题受到全球关注。

近期发展(2024年至今)

2024年,OpenAI发布原生支持文本、音频和图像的多模态模型GPT-4o,以及被设计为在回答前进行更长推理过程的“o1”系列模型;同年还公布了文生视频系统Sora。2024年5月,联合创始人兼首席科学家苏茨克维离职,其后多位知名安全研究人员相继离开,引发外界对该公司安全文化的批评。多名员工(包括前员工)就限制性的离职协议提交了举报投诉。

2024年至2025年间,OpenAI推进重组计划,拟将其营利部门转变为特拉华州公共利益公司,同时由原非营利机构保留控制权及相应股权;这一过程在加州与特拉华州总检察长的监督下进行,并伴随广泛的公共讨论,至2025年10月宣布基本完成,微软在重组后持有营利实体约27%的股权。2025年1月,OpenAI宣布与软银、甲骨文等公司联合发起“星际之门”(Stargate)计划,在美国建设大规模人工智能数据中心基础设施,计划投入规模据宣布高达5000亿美元。2025年,公司相继发布新一代推理模型(包括o3)及GPT-5,并将Sora作为独立消费级应用推出。

公司的崛起亦伴随法律争议:马斯克自2024年起对OpenAI提起诉讼,指控其背弃创立时的非营利使命;公司还面临版权侵权诉讼,其中最引人注目的是2023年12月《纽约时报》提起的诉讼,此外还有来自作家、新闻机构和其他权利人的多起诉讼。

主要产品与研究

OpenAI的产品与研究组合以大规模生成式模型为核心:

  • GPT系列语言模型。 该系列始于GPT-1(2018年),历经GPT-2(2019年)、GPT-3(2020年)、GPT-3.5、GPT-4(2023年)、GPT-4o(2024年)及后续型号。这些基于变换器(Transformer)架构的模型在海量文本语料上训练以预测下一个词元,随着规模扩大,其语言理解、写作、编程和推理能力持续增强。
  • ChatGPT。 2022年11月上线,为OpenAI的模型提供对话式界面,支持代码执行、网页浏览、文件分析、图像生成和语音交互等功能,提供免费及付费订阅(包括ChatGPT Plus、Pro及企业级方案),已成为全球使用最广泛的人工智能应用之一。
  • DALL·E。 文生图系统家族(DALL·E、DALL·E 2、DALL·E 3),能够依据自然语言描述生成和编辑图像。
  • Sora。 2024年公布的文生视频模型,可根据文字提示生成短视频片段,后作为独立应用发布。
  • Whisper。 基于多语言音频数据训练的开源自动语音识别系统。
  • Codex及编程工具。 代码生成模型,支撑了GitHub Copilot,并于2025年推出名为Codex的软件工程智能体。
  • API平台。 开发者接入OpenAI模型的商业接口,成为庞大AI应用生态的基础。
  • 早期研究成果。 包括用于强化学习的Gym与Universe、OpenAI Five和Dactyl机械手,在强化学习及仿真到现实迁移等技术方面有所贡献。

公司还制定了Model Spec和使用政策以规范其系统的可接受用途,并通过发布“系统卡片”说明模型的能力与局限。

特点

混合治理与融资结构。 OpenAI的独特之处在于将非营利母公司与封顶营利运营公司相结合。该结构旨在既吸引大规模人工智能开发所需资本,又名义上维护公益使命。2023年的领导层危机及其后的重组方案,使外界对该安排能否充分保护公众利益的审视显著加剧。

以规模为导向的研究战略。 公司长期奉行“规模化假说”(scaling hypothesis),即模型能力随算力、数据和参数的增加而可预测地提升。GPT系列的连续成功验证了这一战略,公司也据此对计算基础设施进行了巨额投入。

开放程度的演变。 尽管名称中含有“Open”,OpenAI已从详细发表研究成果转向以产品发布和有限技术信息为主,理由涉及安全与竞争考量。从GPT-2、Whisper等相对开放的发布到GPT-4等完全闭源的模型,这一轨迹使其成为人工智能研究透明度与可复现性争论的焦点。

安全与对齐研究。 OpenAI设有人工智能对齐、可解释性和安全评估方面的专门团队,并建立了评估前沿模型风险的“准备框架”(Preparedness Framework)。包括前员工在内的批评者一度认为商业压力已超越安全承诺;公司则对这一说法予以否认。

生态整合。 依托与微软的伙伴关系,OpenAI的模型被嵌入Microsoft 365(以Copilot形式)、必应、Azure OpenAI服务和Windows等广泛使用的平台,大幅扩展了其产品触达范围。

影响与意义

OpenAI对人工智能领域乃至整个社会的影响深远。2022年底ChatGPT的发布被普遍视为分水岭事件,使生成式人工智能进入主流公众视野,促使企业、政府和教育机构迅速重新审视其与人工智能技术的关系。公司历次模型发布屡次刷新技术标杆,其规模驱动的研发路径重塑了整个行业的竞争格局,推动谷歌、Anthropic、Meta、xAI等企业加速投入 comparable 模型与算力建设,形成所谓的“规模化竞赛”。

在公共政策层面,ChatGPT引发的冲击促使各国加快人工智能监管进程,包括美国2023年10月签署的关于人工智能的行政命令、欧盟《人工智能法案》的推进,以及2023年11月英国举办的首届全球人工智能安全峰会及其成果《布莱切利宣言》等。在教育、创意产业和劳动市场等领域,生成式工具带来了生产力提升与学术诚信、职业结构变化等新议题的讨论。

与此同时,OpenAI也处于多项争议的中心,包括训练数据的版权问题、虚假信息和深度伪造风险、模型能耗与资源消耗,以及少数机构集中掌握前沿人工智能能力所引发的治理关切。公司估值与用户规模的快速增长——据报道其2024年后估值达千亿美元级别、ChatGPT周活跃用户数亿计——亦使其成为观察人工智能产业化进程的代表性样本。无论如何评价其战略与治理的演变,OpenAI的发展历程已成为理解当代人工智能技术、产业与社会互动关系的重要案例。

评论区 (0)

U

还没有评论,来抢沙发!

你感兴趣的百科

相关百科