OpenAI
OpenAI(开放人工智能公司)是一家总部位于美国加利福尼亚州旧金山的人工智能研究与发展公司。该公司成立于2015年12月,最初为非营利研究实验室,宣称的使命是确保人工通用智能(AGI)——即设想中能够匹配或超越人类能力的智能系统——造福全人类。OpenAI以研发生成式预训练变换器(GPT)系列大型语言模型、文生图系统DALL·E以及对话式人工智能ChatGPT而闻名,其中2022年11月发布的ChatGPT被广泛视为引发全球生成式人工智能热潮的标志性产品。随着发展,公司逐步由纯非营利机构演变为“非营利母公司+封顶营利子公司”的混合结构,其后又推动营利部门向公共利益公司转型,并与微软建立了深度的投资、算力与产品合作关系。截至2020年代中期,OpenAI已成为全球人工智能行业最具影响力的机构之一。
背景
OpenAI的诞生与2010年代人工智能技术的快速进步密切相关。依托图形处理器(GPU)算力的提升和大规模数据集的积累,深度学习方法在图像识别、语音处理和博弈等领域接连取得突破。谷歌旗下的DeepMind与Facebook人工智能研究(FAIR)等机构取得的成果,既激发了公众对人工智能前景的期待,也引发了对技术发展失控风险的担忧。
在此背景下,一批技术专家和企业家于2015年共同发起创立了OpenAI,其中包括时任特斯拉和SpaceX首席执行官的埃隆·马斯克、时任创业孵化器Y Combinator总裁的萨姆·奥尔特曼(Sam Altman)、前Stripe高管格雷格·布罗克曼(Greg Brockman)、来自谷歌大脑的知名深度学习研究者伊利亚·苏茨克维(Ilya Sutskever),以及沃伊切赫·扎雷姆巴(Wojciech Zaremba)和约翰·舒尔曼(John Schulman)等人;彼得·蒂尔(Peter Thiel)、里德·霍夫曼(Reid Hoffman)、杰西卡·利文斯顿(Jessica Livingston)等提供了早期支持,创立时承诺投入的资金总额为10亿美元。
创始人的核心动机可归纳为两点。其一,他们担心先进的人工智能若仅由少数资金雄厚的公司或政府在缺乏安全考量的情况下开发,可能带来生存层面的风险。其二,他们认为当时已知的构建安全人工智能的最有效路径——在大规模数据上训练大型系统——需要与顶尖私营实验室相当的资金和人才规模,而这样的实验室理应以面向公共利益、并尽可能开放的非营利形式运作。"OpenAI"这一名称即体现了其早期承诺公开发表研究成果、与公众共享专利和代码的立场。
历史沿革
创立与早期研究(2015—2018)
成立之初,OpenAI作为非营利研究实验室运作,陆续发布学术论文,并推出强化学习研究工具包Gym、用于跨软件环境评估智能体能力的平台Universe等工具。实验室招募了多位知名研究者,研究方向涵盖机器人、强化学习和语言建模。2018年,团队构建了在复杂电子游戏《Dota 2》中与职业选手对抗的系统OpenAI Five,以及通过仿真训练操控实体物品的机械手Dactyl。同年2月,马斯克退出董事会,其表述的原因是避免与特斯拉的人工智能研发产生利益冲突,此后一段时间内他仍为捐赠者。2018年,OpenAI还发布了GPT-1,开启了其影响深远的大型语言模型系列。
结构重组与微软合作(2019—2021)
2019年,OpenAI宣布其结论为:训练规模日益庞大的AI系统所需的资本远超非营利机构的筹款能力,为此设立了“封顶盈利”子公司OpenAI LP(后更名为OpenAI Global, LLC),投资者和员工的回报被限定为投资额的一定倍数(最初为100倍),超出部分利润归属非营利母公司。同年,微软向公司投资10亿美元,并成为其独家云计算服务提供商。2020年,OpenAI将GPT-3授权给微软,后者将其整合进商业产品。
在此期间,OpenAI分阶段发布GPT-2:最初以担心滥用为由未公开完整模型,这一决定引发了关于人工智能成果发布规范的重大争论,直至2019年11月才完整开放。2021年,公司发布了根据文字描述生成图像的系统DALL·E,以及驱动GitHub Copilot的代码生成模型Codex。
ChatGPT时代(2022—2023)
2022年,OpenAI先后推出DALL·E 2和语音识别系统Whisper。2022年11月30日,公司发布了基于GPT-3.5的对话式产品ChatGPT,成为其发展史上的转折点。该聊天机器人据估计在两个月内即获得约1亿用户,创下当时消费级应用增长速度的纪录,并促使公众和商业界大规模关注生成式人工智能。2023年初,微软扩大投资,据报道承诺投入约100亿美元,并将OpenAI的模型整合进其多条产品线。2023年3月,OpenAI发布多模态模型GPT-4,其推理能力和在专业考试中的表现较前代显著提升。同年晚些时候,公司推出允许用户构建自定义聊天机器人的GPTs功能,并在后续模型中预演了更为先进的“推理”能力。
领导层危机(2023年11月)
2023年11月,OpenAI非营利董事会突然解除奥尔特曼的首席执行官职务,理由是其在沟通中“并非始终坦诚”;布罗克曼随后辞职以示声援。此举引发了持续五天的公司动荡:数百名员工联名致信,威胁若不恢复奥尔特曼职务并改组董事会将集体离职。在微软参与斡旋(其间微软表态愿意聘用出走团队)之后,奥尔特曼复职,董事会改组并由布雷特·泰勒(Bret Taylor)出任主席。该事件使前沿人工智能实验室的治理结构、商业化与安全优先级之间的张力,以及对强大人工智能系统影响力的集中等问题受到全球关注。
近期发展(2024年至今)
2024年,OpenAI发布原生支持文本、音频和图像的多模态模型GPT-4o,以及被设计为在回答前进行更长推理过程的“o1”系列模型;同年还公布了文生视频系统Sora。2024年5月,联合创始人兼首席科学家苏茨克维离职,其后多位知名安全研究人员相继离开,引发外界对该公司安全文化的批评。多名员工(包括前员工)就限制性的离职协议提交了举报投诉。
2024年至2025年间,OpenAI推进重组计划,拟将其营利部门转变为特拉华州公共利益公司,同时由原非营利机构保留控制权及相应股权;这一过程在加州与特拉华州总检察长的监督下进行,并伴随广泛的公共讨论,至2025年10月宣布基本完成,微软在重组后持有营利实体约27%的股权。2025年1月,OpenAI宣布与软银、甲骨文等公司联合发起“星际之门”(Stargate)计划,在美国建设大规模人工智能数据中心基础设施,计划投入规模据宣布高达5000亿美元。2025年,公司相继发布新一代推理模型(包括o3)及GPT-5,并将Sora作为独立消费级应用推出。
公司的崛起亦伴随法律争议:马斯克自2024年起对OpenAI提起诉讼,指控其背弃创立时的非营利使命;公司还面临版权侵权诉讼,其中最引人注目的是2023年12月《纽约时报》提起的诉讼,此外还有来自作家、新闻机构和其他权利人的多起诉讼。
主要产品与研究
OpenAI的产品与研究组合以大规模生成式模型为核心:
- GPT系列语言模型。 该系列始于GPT-1(2018年),历经GPT-2(2019年)、GPT-3(2020年)、GPT-3.5、GPT-4(2023年)、GPT-4o(2024年)及后续型号。这些基于变换器(Transformer)架构的模型在海量文本语料上训练以预测下一个词元,随着规模扩大,其语言理解、写作、编程和推理能力持续增强。
- ChatGPT。 2022年11月上线,为OpenAI的模型提供对话式界面,支持代码执行、网页浏览、文件分析、图像生成和语音交互等功能,提供免费及付费订阅(包括ChatGPT Plus、Pro及企业级方案),已成为全球使用最广泛的人工智能应用之一。
- DALL·E。 文生图系统家族(DALL·E、DALL·E 2、DALL·E 3),能够依据自然语言描述生成和编辑图像。
- Sora。 2024年公布的文生视频模型,可根据文字提示生成短视频片段,后作为独立应用发布。
- Whisper。 基于多语言音频数据训练的开源自动语音识别系统。
- Codex及编程工具。 代码生成模型,支撑了GitHub Copilot,并于2025年推出名为Codex的软件工程智能体。
- API平台。 开发者接入OpenAI模型的商业接口,成为庞大AI应用生态的基础。
- 早期研究成果。 包括用于强化学习的Gym与Universe、OpenAI Five和Dactyl机械手,在强化学习及仿真到现实迁移等技术方面有所贡献。
公司还制定了Model Spec和使用政策以规范其系统的可接受用途,并通过发布“系统卡片”说明模型的能力与局限。
特点
混合治理与融资结构。 OpenAI的独特之处在于将非营利母公司与封顶营利运营公司相结合。该结构旨在既吸引大规模人工智能开发所需资本,又名义上维护公益使命。2023年的领导层危机及其后的重组方案,使外界对该安排能否充分保护公众利益的审视显著加剧。
以规模为导向的研究战略。 公司长期奉行“规模化假说”(scaling hypothesis),即模型能力随算力、数据和参数的增加而可预测地提升。GPT系列的连续成功验证了这一战略,公司也据此对计算基础设施进行了巨额投入。
开放程度的演变。 尽管名称中含有“Open”,OpenAI已从详细发表研究成果转向以产品发布和有限技术信息为主,理由涉及安全与竞争考量。从GPT-2、Whisper等相对开放的发布到GPT-4等完全闭源的模型,这一轨迹使其成为人工智能研究透明度与可复现性争论的焦点。
安全与对齐研究。 OpenAI设有人工智能对齐、可解释性和安全评估方面的专门团队,并建立了评估前沿模型风险的“准备框架”(Preparedness Framework)。包括前员工在内的批评者一度认为商业压力已超越安全承诺;公司则对这一说法予以否认。
生态整合。 依托与微软的伙伴关系,OpenAI的模型被嵌入Microsoft 365(以Copilot形式)、必应、Azure OpenAI服务和Windows等广泛使用的平台,大幅扩展了其产品触达范围。
影响与意义
OpenAI对人工智能领域乃至整个社会的影响深远。2022年底ChatGPT的发布被普遍视为分水岭事件,使生成式人工智能进入主流公众视野,促使企业、政府和教育机构迅速重新审视其与人工智能技术的关系。公司历次模型发布屡次刷新技术标杆,其规模驱动的研发路径重塑了整个行业的竞争格局,推动谷歌、Anthropic、Meta、xAI等企业加速投入 comparable 模型与算力建设,形成所谓的“规模化竞赛”。
在公共政策层面,ChatGPT引发的冲击促使各国加快人工智能监管进程,包括美国2023年10月签署的关于人工智能的行政命令、欧盟《人工智能法案》的推进,以及2023年11月英国举办的首届全球人工智能安全峰会及其成果《布莱切利宣言》等。在教育、创意产业和劳动市场等领域,生成式工具带来了生产力提升与学术诚信、职业结构变化等新议题的讨论。
与此同时,OpenAI也处于多项争议的中心,包括训练数据的版权问题、虚假信息和深度伪造风险、模型能耗与资源消耗,以及少数机构集中掌握前沿人工智能能力所引发的治理关切。公司估值与用户规模的快速增长——据报道其2024年后估值达千亿美元级别、ChatGPT周活跃用户数亿计——亦使其成为观察人工智能产业化进程的代表性样本。无论如何评价其战略与治理的演变,OpenAI的发展历程已成为理解当代人工智能技术、产业与社会互动关系的重要案例。
你感兴趣的百科
地球
地球(英语:Earth)是太阳系由内向外计算的第三颗行星,是太阳系中直径、质量和密度最大的类地行星,也是目前人类已知的唯一孕育并支持生命存在的天体。地球距离太阳约1.496亿千米(即1个天文单位),拥有一颗天然卫星——月球。地球表面约71%...
国际象棋
国际象棋(Chess)是一种在8×8方格、共64格的棋盘上由两名棋手对弈的策略性棋类游戏,双方各统领十六枚棋子,以将死对方的王为最终目标。国际象棋被广泛视为世界上历史最悠久、智力要求最高的棋艺活动之一,兼具艺术、科学与竞技体育的特质,在全球...
Qwen(通义千问)
Qwen(中文:通义千问;拼音:Tōngyì Qiānwèn),国际上也称“Tongyi Qianwen",是阿里巴巴集团旗下云计算业务阿里云开发的大型语言模型(LLM)与多模态人工智能模型系列。该系列于2023年4月首次发布,此后发展为覆...
Anthropic
Anthropic(中文名称常译作“安斯罗皮克”或音译“人类技术公司”,一般直接使用英文名称)是一家总部位于美国加利福尼亚州旧金山的人工智能安全与研究公司。该公司由前OpenAI研究人员于2021年创立,联合创始人包括达里奥·阿莫迪与达妮埃...
相关百科
Anthropic
Anthropic(中文名称常译作“安斯罗皮克”或音译“人类技术公司”,一般直接使用英文名称)是一家总部位于美国加利福尼亚州旧金山的人工智能安全与研究公司。该公司由前OpenAI研究人员于2021年创立,联合创始人包括达里奥·阿莫迪与达妮埃...
托马斯·哈代
托马斯·哈代(英语:Thomas Hardy,1840年6月2日—1928年1月11日),英国小说家、诗人,被公认为维多利亚时代文学的代表性作家之一。其作品大多以英格兰西南部半虚构的地区“威塞克斯”(Wessex)为背景,探讨命运、社会束缚...
印度
印度(英语:India),全称印度共和国(Republic of India),是位于南亚的主权国家,也是世界上人口最多的国家,人口超过14亿。印度国土面积约328万平方公里,居世界第七位,南临印度洋,西南濒阿拉伯海,东南临孟加拉湾,陆地与...
第二次世界大战
第二次世界大战(1939年9月1日—1945年9月2日,常简称“二战”或“二次大战”),是以纳粹德国、大日本帝国和意大利王国为首的轴心国,与以英国、苏联、美国和中华民国为首的同盟国之间进行的一场全球性军事冲突,是人类历史上规模最大、波及范围...
评论区 (0)
还没有评论,来抢沙发!