斯坦福研究:超半数AI独角兽从未发表论文
AI 模型發展已走入黑箱,超過一半獨角獸從沒發過論文
这是一份来自斯坦福团队的硬核计量研究,系统揭示了AI独角兽在科学文献中的参与度极低且高度集中,对评估AI公司技术实力与投资风险有参考价值,建议关注原文数据与后续讨论。
本文為史丹佛大學 John P.A. Ioannidis 團隊 2026 年 7 月 16 日發表於 bioRxiv 的預印本論文《AI 獨角獸新創在科學文獻中的參與度微不足道》(Negligible participation in the scientific literature of AI unicorn startups)全文翻譯,原論文採 CC-BY 授權,由動區動趨翻譯整理。
(前情提要:OpenAI 財務黑洞浮現:單年虧 385 億美元,分析師警告連鎖崩盤即將開跑)
(背景補充:OpenAI 前技術長 Mira Murati 兩年首作實測:西方最強開源 AI,實測卻被手機模型打敗)
重點摘要 研究分析全部 317 家 AI 獨角獸新創(1998 至 2025 年),僅找到 1,389 篇合格同儕審查論文與 688 篇預印本,超過一半公司(52.4%)沒有任何合格科學產出。
科學影響力極度集中:前 10% 公司拿走 96.8% 的引用,OpenAI 一家就佔全部引用的 39.4%,其次是曠視科技(MEGVII)26.6%、Hugging Face 6.9%。
公司估值與發表產能、高被引論文數量之間沒有顯著關聯;2025 年這些公司合計只佔全球 AI 文獻的 0.103%。
研究資訊 論文標題:Negligible participation in the scientific literature of AI unicorn startups(AI 獨角獸新創在科學文獻中的參與度微不足道)
作者:Quentin E.A. Loisel、Alejandro Sandoval-Lentisco、John P.A. Ioannidis(通訊作者,史丹佛大學)
發布日期:2026 年 7 月 16 日|來源:bioRxiv 預印本(DOI: 10.64898/2026.07.15.738744)
摘要 人工智慧(AI)的發展集中在私人企業手中,但這些企業參與科學發表的情況一直缺乏了解。我們對全部 317 家 AI 獨角獸新創(1998 至 2025 年)進行文獻計量分析,僅辨識出 1,389 篇合格的同儕審查論文與 688 篇預印本,其中包含某種程度的新創公司主導貢獻。超過半數的新創公司(52.4%)沒有產出任何合格的科學成果,只有 24 家公司(7.6%)產出過任何高被引論文(引用數 200 次以上)。科學影響力高度集中:前 10% 的公司佔了 96.8% 的引用,而三家新創公司就包辦了 134 篇可歸屬於公司的高被引論文中的 92 篇。公司估值與發表產能或高被引產出之間沒有關聯,募資金額則呈現微弱的關聯。整體而言,AI 獨角獸新創參與正式科學傳播的程度微不足道,在 2025 年僅佔整體 AI 文獻的 0.1%。大多數 AI 技術的領先開發者並不參與科學文獻,這對這個快速推進的創新前沿在透明度、可重現性與問責上構成隱憂。
前言 人工智慧(AI)研究已日益從大學與公立實驗室,轉移到擁有大規模運算基礎設施、專有資料與集中技術人才的私人企業手中(1)。商業 AI 實驗室與新創公司如今在開發前沿模型與能力上扮演核心角色,這些模型與能力影響著科學研究、軟體工程、醫學、教育與公共傳播(2)。與此同時,過去十年間產業界在大規模模型開發與基準測試表現上的參與程度已大幅提升(1, 3)。
科學發表始終是研究成果得以傳播、受檢視並納入累積性知識體系的核心機制。發表確立了科學優先權、促成獨立評估、支持可重現性,並提供技術進展的公開紀錄。隨著前沿 AI 開發愈來愈集中於私人組織,理解這些公司是否參與正式的科學傳播,攸關知識的可見度、透明度與集體發展。
發表活動也可能具備科學傳播之外的功能,包括招募人才、彰顯技術領導地位、影響生態系,以及在快速演變的競爭市場中進行策略定位。隨著前沿 AI 系統能力愈強、社會影響愈大,關於透明度、可重現性與治理的疑慮也日益突出(3)。類似的疑慮也曾在其他創新密集的產業被提出,一些高估值新創公司,例如 Theranos(一起詐欺案例)以及許多看似正當的獨角獸,有時宣稱自己創造了重大技術進展,卻幾乎沒有產出任何經同儕審查的科學證據(4 至 6)。儘管外界對前沿 AI 公司的能力、估值與治理興趣漸增(3, 7),這些公司在科學文獻中的參與情況仍然缺乏描述。
在此,我們系統性檢視了 AI 獨角獸新創的科學發表活動,AI 獨角獸新創的定義是估值達 10 億美元以上的未上市 AI 公司。我們使用取自 Clarivate 資料庫的發表與預印本紀錄,辨識出與 317 家 AI 獨角獸新創相關、且屬於 AI 領域的科學產出。為了把新創公司的實質參與,與範圍更廣的合作性參與區分開來,公司層級的分析聚焦於具有主導作者貢獻的論文,主導作者的定義為第一作者或最後作者,或在作者依字母順序排列時視同主導。我們評估了科學發表的參與度、科學產能、引用影響力、高被引論文(引用數 200 次以上)的產出、發表與引用的集中度、作者隸屬單位的樣態,以及科學發表活動、財務規模與地理位置之間的關係。
結果:參與科學發表的程度極不均等 最終資料集(見補充資料:方法與材料)涵蓋總部設於 25 個國家的 317 家 AI 獨角獸新創,合計關聯 2,077 項合格科學產出,包括 1,389 篇同儕審查論文與 688 篇預印本。其中 132 篇(6.4%)獲得至少 200 次引用,構成本研究認定的高被引論文集合。
各公司之間的發表活動極不均等(圖 1A)。超過半數的新創公司沒有產出任何合格成果(317 家中有 166 家,52.4%),其餘多數公司也只產出少量論文(中位數 4 篇),只有少數幾家公司維持著持續的發表活動(最多者 243 篇)。
當檢視的是科學影響力而非單純的發表量時,這種不平等更加顯著(圖 1B)。勞倫茲曲線顯示發表與引用都呈現極端集中,且引用的不平等程度(吉尼係數 0.97)高於發表篇數(吉尼係數 0.86)。後半數公司在觀察到的...
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力