30 万亿美元不是 Anthropic 明年的收入,也不是一份公司已经公开的测算表。
8 月 25 日,Reuters 转述《华尔街日报》称,Anthropic 可能向投资者提出超过 30 万亿美元的总可寻址市场。报道把 TAM 定义为产品拿到 100% 市占时的理论年收入机会,并称 Anthropic 从“AI 模型能够完成的全部工作范围”出发估算。Anthropic 没有即时回应 Reuters。1
这个数字仍然值得研究。它第一次把模型公司的市场边界说得足够直白:不再只算软件席位和 API 预算,开始计算工作本身。
三个数字不能相加。第一个是媒体报道的市场上限,第二个是短期收入的年化口径,第三个是特定软件任务的能力边界;30 万亿美元能不能成立,要看收入能否穿过周期,长任务能否进入更多行业,结果能否被外部验证。
- Reuters 转述的报道说,Anthropic 的 TAM 超过 30 万亿美元;其方法从模型可完成的全部工作范围出发。TAM 是 100% 市占下的理论年收入机会,不是公司收入预测。1
- Anthropic 于 2026 年 5 月完成 650 亿美元 Series H,投后估值 9,650 亿美元;公司当月披露收入运行率超过 470 亿美元。Reuters 随后报道,截至 7 月底该口径超过 650 亿美元。2 3
- 最新 Economic Index 改为连续采样。公司分类器认为 93% 的 Claude 对话产出了可辨认的成果物;在 31 类成果物中,Claude Code 有 26 类的任务委托程度高于 chat 与 Cowork。5
- METR 5 月更新显示,早期 Mythos Preview 的 50% 任务时长已经触及 16 小时测量上限;16 小时以上无法由当前任务集可靠估计。13 14
- 一项覆盖 6,500 多万篇论文、专利和软件产品的 Nature 研究发现,小团队更常产生颠覆性工作,大团队更常发展既有方向;论文同时强调两类团队都不可缺。7
- Anthropic 没有公开 30 万亿美元的任务分类、渗透率、价值捕获率和公司份额。本文只拆变量,不补百分比。
- 本文把“前沿任务”定义为需要长时推理、工具调用、失败恢复和外部验证的工作。这个框架不是 Anthropic 公布的 TAM 分项。
- 中国能否追赶取决于光刻机和芯片制程突破,也取决于 HBM、先进封装、互连、软件和集群效率能否一起跟上。
- 30 万亿美元真正押注的不是聊天机器人渗透率,而是模型公司能否成为任务执行层,从普通办公一路进入科学、工程和医疗。
- 前沿智力过去受少数人才和团队的时间约束。模型、工具与算力把一部分高阶尝试变成可复制、可并行的供给,这才是 Anthropic TAM 最激进的部分。
- 中美模型不能只看公开测评。如果一方更早把有效算力投入长任务和科学反馈,榜单接近时,实际差距仍可能扩大。
这 30 万亿美元从哪里来
TAM 的算术不复杂。缺的是输入。
Reuters 的口径是 100% 市占下的理论年收入机会。《华尔街日报》给出的线索只有一条:Anthropic 从 AI 可以完成的全部工作范围出发。1 没有任务清单,没有采用率,也没有客户愿意让渡多少价值的假设。
- 01>$30T 理论年收入REPORTED TAM
- 02AI 进入任务PENETRATION
- 03可靠完成SUCCESS RATE
- 04客户付费价值VALUE CAPTURE
- 05Anthropic 份额COMPANY SHARE
第一格采用《华尔街日报》报道、Reuters 转述的 TAM 口径。后四格是作者用于拆解市场上限的变量;Anthropic 没有公开各环节百分比,因此图中不计算公司收入。
所以 30 万亿美元不能直接拿来给 Anthropic 做收入预测,可实现收入至少还要经过 AI 渗透率、可靠完成率、价值捕获率和公司份额;任何一项很低,乘出来都很小。
Anthropic 在 5 月 28 日完成 650 亿美元 Series H,投后估值 9,650 亿美元。融资额包含 150 亿美元此前已经承诺的云厂商投资;公司还披露,5 月初收入运行率已经超过 470 亿美元。资金将用于安全与可解释性研究、算力、产品和合作。2
这轮融资也把算力写进了资产负债表。Anthropic 公告列出的协议包括 Amazon 最高 5 GW 新容量、Google 与 Broadcom 的 5 GW 下一代 TPU 容量,以及 SpaceX Colossus 1 和 Colossus 2 的 GPU 容量。签约上限不等于已经上线,但它说明公司在同时采购模型训练、推理交付和长任务搜索所需的工业基础设施。2
6 月 1 日,Anthropic 宣布已秘密提交 draft S-1,发行规模和价格仍未确定。4 Reuters 8 月 17 日又引述知情人士称,公司截至 7 月底的收入运行率超过 650 亿美元;这是把短期销售水平年化后的媒体口径,不是 Anthropic 新发布的经审计年度收入。3
市场边界落在任务上
软件公司习惯按席位收费,Anthropic 试图按任务重新画边界。
Anthropic 最新 Economic Index 已经不再用一周快照回答这个问题。6 月 26 日的报告改为连续隐私保护采样,并把 chat、Cowork、Claude Code 和第一方 API 分开统计。原因很直接:Claude Code 与 Cowork 的长时智能体任务越来越多,只看对话文本已经看不清模型到底交付了什么。5
公司分类器把 93% 的 Claude 对话识别为产出了成果物。最常见的是解释、文档与报告、建议;代码和技术工作约占六分之一。更接近任务执行的是 Claude Code:31 类成果物中有 26 类的任务委托程度高于 chat 与 Cowork,平均高 0.37 分;只比较 Sonnet 会话,差距仍有 0.26 分。5
这些分数不是成功率。它们来自 Anthropic 自己的分类器,也没有告诉我们成果物是否被客户采用。报告另有约 9,700 名 Claude 用户的调查,超过 35% 预计一年后 AI 能完成自己大部分或几乎全部工作任务;计算机与管理职业在样本中过度代表,因此这只能说明用户预期,不能当成 TAM 已兑现的比例。5
最新数据仍然说明一件事:工作正在被拆成模型可以接手、交付并留下成果物的任务单元。TAM 的分母由此从“有多少人买 Claude”变成“有多少任务可以交给 Claude”,而真正的分子要等成功率和客户付费来确认。
代码是第一个大市场,因为输入、执行和测试都在机器里;科学研究难得多,数据库、实验设备、负结果和现实噪声都在系统之外,Anthropic 若要把市场推到 30 万亿美元,能力就不能停在代码和文档。
天降伟人开始变成算力问题
Anthropic 在 2026 年的一份情景文件里再次使用“数据中心里的天才之国”来描述变革性 AI。6 这是公司对未来的情景,不是今天已经实现的能力。
这句话抓住了 30 万亿美元背后的野心。历史上的前沿工作受人类认知带宽约束,研究者一天只有 24 小时,优秀团队数量有限,同一条路线能并行尝试的次数也有限;模型实例可以复制,搜索可以并行,失败可以快速回收,智力开始有了工业产能的样子。
“天降伟人”也不能当成历史事实的全部。Nature 对 6,500 多万项科研与技术产出的研究发现,小团队更常做颠覆性工作,大团队更常沿已有路线发展,两者共同构成科研体系。7 突破来自个人判断、团队协作、仪器、制度和积累,不是一个英雄单独完成。
- 01稀缺个人判断HUMAN INSIGHT
- 02研究团队INSTITUTION
- 03模型实例REPLICABLE
- 04工具与评估器GROUNDING
- 05算力并行SEARCH SCALE
- 06前沿任务系统VERIFIED WORK
作者的能力演化框架。模型实例和搜索次数可以复制,人类设题、数据质量、评估器、实验设备与价值选择仍是约束。
会考试不等于会发现
公开测评能快速比较模型版本,题目公开以后,团队也知道该往哪里优化;一张静态榜单测不完长任务可靠性、工具调用、失败恢复和现实环境变化,NIST AI 800-3 则用统计模型检查评估中的假设与不确定性,并把基准结果能否外推到现实环境列为仍待解决的问题。8
- 01公开基准KNOWN TASKS
- 02长任务TOOLS · RECOVERY
- 03新假设TESTABLE IDEA
- 04外部验证PROOF · WET LAB
- 05真实成果SCIENCE · ENGINEERING
定性分析框架,不是模型评分。越往右,越依赖长任务、工具、外部评估器与现实验证;同一系统可能只在某个环节有效。
后面三格才接近前沿任务。
AlphaFold 在 CASP14 的多数目标上给出可与实验结构竞争的蛋白质结构预测,改变了结构生物学的工作方式。12 FunSearch 让大语言模型生成程序,再由自动评估器筛选和迭代,最终在 cap set 问题上找到新构造,也改进了特定装箱启发式。9
2026 年发表于 Nature 的 AI co-scientist 又往前走了一步,系统在三类生物医学场景中提出假设,部分方向进入细胞或类器官验证;这些结果都有人类设题、工具和实验参与。10 真实世界不接受模型自评。
到 8 月,Anthropic 自己也开始交出前沿任务结果。一套未公开研究版 Claude 用约 3,100 万输出 Token、约 60 个子智能体和一天半搜索,把黎曼 ζ 函数临界线上零点比例的已知下界从 41.6% 提高到 67.2%,并生成了通过标准检查器的 Lean 形式化。它没有解决黎曼猜想,结果也尚未进入独立同行评审;这仍是公司研究,只是验证方式比模型自评更强。15
另一组公司实验更接近现实科研。Claude 针对 15 个蛋白靶点设计 minibinder,外部实验室在其中 14 个靶点上测到结合体;不同运行方式的总体命中率为 22.6% 至 35.1%。多靶点运行给了模型 48 小时时间和最高 12,500 个 H100 小时,由它调用专业蛋白设计与折叠模型。结果由 Adaptyv Bio 与 Twist Bioscience 生产并测试,但研究仍由 Anthropic 主导,尚未同行评审;minibinder 也只是药物发现早期的一步。16
失败更能暴露结构。Anthropic 的 VirBench 覆盖 120 个病毒序列查询,裸智能体的平均准确率从 16.9% 到 91.3% 不等;接入确定性检索工具后才全部超过 90%,最高达到 99.7%。11 能力不只在权重里。数据库接口、评估器和实验系统都会决定结果。
任务时长决定可卖的市场
模型能做多长的任务,比它会多少道题更接近 TAM。METR 的 50% 任务时长不是模型实际运行多久,而是模型有一半概率完成、且人类专家需要相应时间才能完成的任务难度。13
5 月发布的 Frontier Risk Report 把公开前沿的 TH1.1 50% 任务时长放在约 12 小时,区间为 5 至 61 小时。早期 Mythos Preview 的点估计落在 16 至 20 小时,95% 区间约为 8.5 至 55 小时;METR 同时明确警告,当前任务集在 16 小时以上已经无法可靠测量。13 14
TH1.1 主要由低上下文、可自动判分的软件、机器学习和网络安全任务组成。高低 messiness 两项为 Opus 4.6 子集结果;Mythos Preview 为早期版本点估计区间,16 小时以上不可靠。任务时长按人类专家完成难度计,不是模型实际运行时间。
量尺的干净程度比数字更重要。TH1.1 有 228 个任务,主要集中在软件、机器学习和网络安全;其中任务的最高 messiness 只有 6/16,而 METR 估计“写一篇好研究论文”大约是 9–15/16。Opus 4.6 在低 messiness 子集是 17.8 小时,高 messiness 子集只剩 6.4 小时。14
方向已经很清楚,外推仍要克制。模型在可判分的软件任务上从几分钟推进到半天,并开始碰到现有基准上限;如果它能在更混乱的任务里维持同样可靠性,药物研发和复杂工程才可能进入同一张市场地图。
时长就是边界。
Token 是产量,不是护城河
30 万亿美元不能用 Token 总量证明。
一百万个用来续写套话的 token,和一百万个用于代码验证、材料搜索或候选药物筛选的 token,任务价值不在一个量级;价格下降会带来更多调用,难任务又会消耗更长推理和更多工具步骤,收入最后取决于客户是否愿意为结果持续付费。
所以 Token 业务至少看四个数:任务价值、单位结果成本、算力利用率、付费留存。调用量大却没有毛利和留存,只是机器很忙。
追赶条件落在芯片效能
光刻已经不是一张未来路线图。ASML 7 月 15 日公告称,High-NA EUV 已用于部分 Intel 18A Panther Lake 产品的特定层,相关层在俄勒冈完成双重认证,产品以与既有 NXE 平台相当的良率出货;这只代表特定层和部分产品,不代表所有先进节点已经全面切换 High-NA。17
美国管制也不是静止的一堵墙。BIS 2024 年规则覆盖 24 类先进制造设备、3 类软件工具和 HBM。18 2025 年 8 月,BIS 取消部分在华外资晶圆厂的 VEU 免许可待遇,同时表示会考虑维持既有产线的申请,不支持扩产或技术升级。19 2026 年 1 月,H200、MI325X 等芯片在满足条件后改为逐案审查。20 政策有收紧也有局部放宽,但设备、软件、存储和先进计算仍是同一条约束链。
定性因果链。琥珀标出关键约束,堇紫标出最终价值。光刻机与制程决定重要的上游条件;架构、HBM、封装、互连、软件和集群利用率共同决定有效算力。
算力开始进入生命的价格
癌症疫苗最容易把前沿任务的价值讲清楚,而且临床证据刚刚跨了一层。
Intismeran autogene,也就是 V940,会根据患者肿瘤的突变特征,用算法选择并编码最多 34 个个体化新抗原。2026 年 6 月发表的随机 Phase IIb 五年随访纳入 157 名完全切除的高风险黑色素瘤患者;联合 pembrolizumab 组相对单药组的无复发生存 HR 为 0.510,远处无转移生存 HR 为 0.411。五年分析属于描述性更新,整体生存仍只是趋势。21
KEYNOTE-942 随机 Phase IIb 的五年描述性分析,联合组与 pembrolizumab 单药组比较。图中为由 HR 换算的相对风险变化,不是绝对获益;结果属于疫苗与免疫治疗组合,不能归因于 AI 或算力。
8 月 19 日,Merck 与 Moderna 又宣布,1,137 人的 INTerpath-001 Phase III 达到无复发生存和远处无转移生存终点,整体生存继续随访。22 这是公司 topline:效应量、完整安全数据和同行评审全文尚未公布,也不等于监管批准。
Anthropic 与这条产业链的连接已经公开。公司 5 月宣布与 Gates Foundation 在四年内投入 2 亿美元资金、Claude credits 和技术支持,计划把 Claude 用于脊灰疫苗候选的计算筛选,以及 HPV、子痫前期等方向。23 6 月上线的 Claude Science 把 60 多种科研技能和数据库、可审计成果物与弹性计算放进同一个工作台。24 前者是合作计划,后者是产品能力,都不能写成 Claude 已经发现了一款疫苗。
计算有可能压缩数据处理、候选排序、模拟和设计迭代,样本质量、湿实验、GMP 制造、毒理、临床验证和监管却不会因为 GPU 更多就消失。现有临床研究也没有把总周期的缩短因果归给 LLM 或更多算力。
五年后只看三道门
30 万亿美元不用靠情绪判断。看三道门就够了。
任务覆盖能否从代码和文档进入更多行业,50% 成功时长能否从小时走向天,模型提出的结果能否通过证明、实验或独立复现。三道门都打开,Anthropic 卖的是可复制的前沿任务能力;只打开第一道,它仍然是一家很大的软件公司,却很难装下 30 万亿美元。
Anthropic 的 30 万亿美元 TAM,本质上是把稀缺智力改写成算力供给的赌注。任务覆盖决定入口,长时可靠性决定边界,外部验证决定价值。先看这三件事,再谈 30 万亿美元。
- Q1Anthropic 是否公开 30 万亿美元的任务分类、渗透率、价值捕获率和公司份额假设?
- Q2模型在固定、未见过的长任务上,50% 成功时长能否继续提高,而不是只靠用户挑选容易任务?
- Q3哪些系统产出了可由数学证明、湿实验或独立复现确认的新结果?
- Q4Token 增长来自低价和促销,还是进入了有留存、毛利和高任务价值的工作负载?
- Q5中国在光刻机、制程、HBM、先进封装、互连与集群利用率上,哪些约束出现了实质突破?
参考资料
展开其余 21 条收起参考资料
- Reuters via CNA — Anthropic expected to tell investors it sees over $30 trillion in potential revenue(2026-08-25)
- Anthropic — Series H financing at $965 billion post-money valuation(2026-05-28)
- Reuters via CNA — Anthropic revenue run rate tops $65 billion(2026-08-17)
- Anthropic — Confidential draft S-1 submission(2026-06-01)
- Anthropic Economic Index — Cadences(2026-06-26)
- Anthropic — 2028: Two scenarios for global AI leadership(2026-05-14)
- Nature — Large teams develop and small teams disrupt science and technology(2019)
- NIST — Expanding the AI Evaluation Toolbox with Statistical Models
- Nature — Mathematical discoveries from program search with large language models(2023)
- Nature — Accelerating scientific discovery with Co-Scientist(2026)
- Anthropic — Paving the way for AI agents in biology(2026-06-08)
- Nature — Highly accurate protein structure prediction with AlphaFold(2021)
- METR — Task-Completion Time Horizons of Frontier AI Models(更新于 2026-05-08)
- METR — Frontier Risk Report: The messy reality of task horizons(2026-05-19)
- Anthropic — Learning more about Claude's mathematical capabilities(2026-08-10)
- Anthropic — How Claude is accelerating protein design(2026-08-18)
- ASML — High NA EUV reaches new readiness milestone(2026-07-15)
- U.S. BIS — Commerce Strengthens Export Controls on Advanced Semiconductor Production in China(2024-12-02)
- U.S. BIS — Commerce Closes VEU Loophole for Foreign-Owned Semiconductor Fabs in China(2025-08-29)
- U.S. BIS — License Review Policy for Semiconductor Exports(2026-01-13)
- Journal of Clinical Oncology / PubMed — Intismeran Autogene Plus Pembrolizumab: Five-Year Update(2026-06-01)
- Moderna / Merck — Phase 3 INTerpath-001 met RFS and DMFS endpoints(2026-08-19)
- Anthropic — Gates Foundation partnership(2026-05-14)
- Anthropic — Claude Science AI workbench(2026-06-30)
版本记录v1.0 首发 · v1.1 于 2026-08-27 更新 · 公司融资与收入、任务覆盖、长任务、科研实测、癌症疫苗和芯片政策数据更新至 2026-08-27;核心判断不变。
资料截至 2026-08-27。30 万亿美元来自《华尔街日报》报道、Reuters 转述,Anthropic 尚未公开计算表,也未即时回应 Reuters。公司融资、算力合同和收入运行率采用各来源披露时点;运行率是短期收入年化,不是经审计年度收入。Anthropic Economic Index 只反映其披露样本中的 Claude 使用,METR 只测特定软件、机器学习和网络安全任务。Anthropic 科学实测属于公司研究,个性化癌症疫苗数据属于特定临床研究,本文不提供医疗建议。关于 TAM、前沿任务价值、Token 商业模式、中美模型差距以及 Anthropic 的判断均属作者观点,不构成投资建议。
本文包含前瞻性陈述与示意性估算,仅供研究与信息参考,不构成对任何证券的买卖要约或投资建议。所引数据可能与最终披露存在差异,读者应独立核实并自行判断。