水晶鞋效应 - 财报，业绩电话会，研报，新闻

水晶鞋效应

搜索文档

虎嗅APP· 2025-12-13 09:07

以下文章来源于快刀青衣，作者快刀青衣快刀青衣 . 得到联合创始人，AI 学习圈主理人产品经理出身，与罗胖脱不花创业十年学习 AI，使用 AI，只为解决问题当时就有不少媒体猜测，他发警报的最终目的，其实是给这个新模型的宣传造势。但我们确实也能看出，OpenAI在Gemini的强大攻势下，心态已经不像当初那么轻松了。为什么这么说？从GPT-5.1到GPT-5.2，发布间隔只有30天。要知道，这可是OpenAI历史上迭代最快的一次，以前这种级别的版本迭代，至少要一个季度才可以。更关键的是，这次GPT-5.2主打的不是"通用智能""推理能力"这类高大上的概念，而是直截了当地说：我们要强化"打工能力"。什么是打工能力？就是你每天在办公室里干的活，比如做Excel表格、写PPT、改代码、回复客户邮件。这次，OpenAI的很明确：先不谈理想和未来，先把大家手头的活干好再说。一、30天迭代，为何这么急？从GPT-5.1到GPT-5.2仅用30天，你可能觉得，版本号才涨了0.1，能有多大变化？本文来自微信公众号：快刀青衣，作者：快刀青衣，题图来自：AI生成 2015年12月11日，OpenA ...

100万亿Token揭示今年AI趋势，硅谷的这份报告火了

36氪· 2025-12-09 03:21

开源与闭源模型格局演变 - 开源模型使用量稳步增长，预计到2025年底将达到总用量的约三分之一，与闭源模型形成互补关系而非零和博弈 [5][7] - 中国开源模型成为增长主要引擎，其每周Token使用量占比从2024年底的1.2%最高激增至30%，平均占比为13% [5][9] - 开源模型市场从高度集中转向多元化，2025年上半年DeepSeek V3和R1占开源用量一半以上，但预计到年底没有单一模型能持续占比超25%，市场将由5-7个模型均分 [12] 模型形态与市场偏好变化 - 中型模型（参数在150亿至700亿之间）更受市场青睐，小模型（参数少于150亿）正在失宠，市场分化为强大的中型模型类别或整合到最强大的单个大型模型上 [15] - 开源模型不再被视为闭源“平替”，而是找到了特定场景的首选定位，开发者往往同时使用两类模型 [7] 推理模型与工具调用成为新范式 - 模型正从“语言生成系统”转变为“推理执行系统”，使用推理的Token用量从年初可忽略不计增长至超过50% [5][18] - 在所有推理模型中，xAI的Grok Code Fast 1使用的推理流量份额最大，领先于Gemini 2.5 Pro和Gemini 2.5 Flash [19] - 模型调用工具的功能使用占比上升，从最初集中于GPT-4o-mini和Claude 3.5/3.7系列，发展到更多模型支持，Claude 4.5 Sonnet等新玩家取得显著进展 [24] AI主要应用场景与使用方式演变 - 编程和角色扮演是AI模型的主要使用方式，编程查询用量从年初的11%上涨至最近的超50% [6][33] - 在所有编程模型中，Claude系列长期占据主导地位，大部分时间占比超过60%，但其在2025年11月市场份额首次跌破60% [36] - 在开源模型中，角色扮演使用量占比高达52%，中国开源模型DeepSeek的流量中有超过三分之二用于角色扮演和闲聊 [40] - 用户使用模式变复杂，从“写短文”到“解难题”，平均每次提示词长度增加约4倍，完成任务所需Token用量增加近3倍 [26][27][30] - 模型正变成“自动Agent”，用户给出复杂目标后，模型能自行规划步骤、调用工具并在长对话中保持状态以完成任务 [33] 主要厂商模型的应用侧重 - Anthropic模型80%以上流量用于编程和技术任务 [43] - xAI模型同样专注于编程，其技术应用、角色扮演及学术用途在2025年11月下旬显著增长 [47] - Qwen模型主要发力编程端，角色扮演和科学类任务占比随时间波动 [51] - OpenAI模型的工作重点从娱乐休闲活动逐渐转向编程和技术类任务 [53] 用户留存呈现“水晶鞋效应” - 大部分用户会快速流失，但每一代前沿AI模型发布时，会锁定一小批任务需求与其新能力完美匹配的“天选用户”，形成高粘性 [57] - 典型案例如Claude 4 Sonnet和Gemini 2.5 Pro，发布5个月后用户留存率仍保持40%高水平 [57] - “水晶鞋效应”窗口期很短，基本只在模型刚发布被视为“最前沿”的那段时间，一旦竞品发布抹平能力差距，再吸引新用户将非常困难 [57][60] 区域市场与语言使用变化 - AI不再是硅谷独角戏，亚洲地区付费使用量占比从13%翻倍至31% [61] - 北美仍是最大市场，但份额已不足50% [61] - 英语以82%份额占据绝对主导，简体中文以近5%份额位居第二 [61] 模型定价与使用量的关系 - 模型价格下降对使用量的影响比想象中小，价格下降10%，使用量仅增加0.5%-0.7% [61] - 存在“杰文斯悖论”，当模型变得足够便宜且好用，人们会在更多地方、用更长上下文、更频繁地调用，导致总Token用量飙升，总支出可能并不降低 [61]

100万亿Token揭示今年AI趋势！硅谷的这份报告火了

新浪财经· 2025-12-08 12:28

报告核心观点 - 基于对OpenRouter平台自2024年11月至2025年11月超过100万亿Token使用量的分析，报告揭示了AI行业的发展趋势，核心观点包括开源模型与闭源模型形成互补、中国开源模型影响力显著提升、模型使用范式向推理与工具调用转变、编程与角色扮演成为主要应用场景以及用户留存呈现“水晶鞋效应”等 [3][5][6][70] 开源与闭源模型格局演变 - 开源模型使用量持续增长，预计到2025年底将达到总使用量的约三分之一，与闭源模型形成互补关系，而非简单的替代关系 [5][6][71] - 开源模型已找到独特定位，成为特定场景的首选，开发者倾向于同时使用开源和闭源两类模型 [6][71] - 中国开源模型成为增长主要引擎，其每周Token使用量占比从2024年底的1.2%最高激增至30%，平均占比为13%，而其他地区开源模型的平均份额为13.7% [2][7][10][74] - 开源模型市场格局从高度集中转向多元化，2025年上半年DeepSeek V3和R1占据一半以上份额，但下半年随着MiniMax M2、Kimi K2、GPT-OSS等模型发布，市场趋于分散，预计年底没有单一模型能持续占据超过25%的Token用量，市场将由5到7个模型均分 [13][77] 模型形态与架构趋势 - 开源模型形态发生变化，中型模型（参数在150亿到700亿之间）更受市场青睐，小模型（参数少于150亿）正在失宠，市场分化为强大的中型模型类别或整合到最强大的单个大型模型（参数为700亿或更多）上 [16][20][80][85] - 语言模型正从“语言生成系统”转变为“推理执行系统”，使用推理功能的Token用量从年初可忽略不计增长至超过50% [7][18][83] - 在所有推理模型中，马斯克xAI旗下的Grok Code Fast 1使用的推理流量份额最大，领先于Gemini 2.5 Pro和Gemini 2.5 Flash，而几周前Gemini 2.5 Pro还是主力 [21][86] - 模型调用工具的功能使用占比上升，年初该功能集中于GPT-4o-mini和Claude 3.5/3.7系列，年中后更多模型开始支持，生态系统更具竞争性，9月底后Claude 4.5 Sonnet、Grok Code Fast和GLM 4.5等新玩家取得进展 [24][89] 主要应用场景与使用方式 - 编程和角色扮演是AI模型的两大主要使用方式 [7][32][70] - 编程类查询的用量从年初的11%上涨至最近的超过50%，增长最为稳定 [32][97] - 在编程模型领域，Claude系列长期占据主导地位，大部分时间占比超过60%，但到2025年11月其市场份额首次跌破60% [35][100] - 同期，OpenAI在编程领域的市场份额从2025年7月的约2%增长至近几周的约8%，谷歌市场份额稳定在约15%，开源模型如Qwen、Mistral份额稳步提升，其中MiniMax被特别提及为快速崛起的新秀 [35][100] - 在开源模型中，角色扮演的使用量占比达到52%，几乎与编程持平，中国开源模型与西方开源模型在该领域平分秋色 [38][103] - DeepSeek的流量中有超过三分之二是角色扮演和闲聊，显示了其在消费者端的高粘性 [38][103] 主流模型的使用偏好 - Anthropic（Claude）超过80%的流量用于编程和技术任务，是主要的程序员工具 [41][106] - 谷歌模型用途相对宽泛，涵盖法律、科学、技术和常识性查询 [44][109] - 马斯克旗下的xAI同样专注于编程，其技术应用、角色扮演及学术用途在2025年11月下旬显著增长 [47][112] - OpenAI的使用重点随时间从娱乐休闲活动逐渐转向编程和技术类任务 [50][115] - Qwen模型同样发力编程端，角色扮演和科学类任务的使用量随时间有所波动 [52][117] 用户行为与市场动态 - 用户留存呈现“水晶鞋效应”，即新模型发布时若能完美解决特定痛点，就能锁定一批高粘性用户，例如Claude 4 Sonnet和Gemini 2.5 Pro发布5个月后用户留存率仍保持40% [7][55][120] - “水晶鞋效应”的窗口期很短，仅在模型刚发布被视为最前沿时有效，一旦竞品发布、能力差距被抹平，则难以再吸引新用户 [58][59][122][123] - 模型任务复杂度提升，从“写短文”变为“解难题”，用户平均每次提示词长度增加了约4倍，且由于推理消耗更多Token，完成任务所需的总Token用量增加了近3倍 [27][29][92][94] - 模型正演变为“自动Agent”，用户给出复杂目标后，模型能自行规划步骤、调用工具并维持对话状态以完成任务，从“聊天机器人”转变为“智能Agent” [32][97] - 模型价格下降对使用量的影响有限，价格下降10%仅带来使用量0.5%至0.7%的增长 [65][129] - 存在“杰文斯悖论”，即模型降价后，因使用更频繁、上下文更长，总Token消耗可能飙升，总支出未必降低 [60][124][125] 区域与语言市场变化 - AI使用不再是硅谷独角戏，亚洲地区的付费使用量占比从13%翻倍至31% [65][129] - 北美仍是最大市场，但份额已不足50%，地位相对下降 [65][129] - 英语以82%的份额占据绝对主导，简体中文以近5%的份额位居第二 [65][129]

Artificial Intelligence

Artificial Intelligence

100万亿Token揭示今年AI趋势！硅谷的这份报告火了

量子位· 2025-12-08 11:36

文章核心观点 - 基于对OpenRouter平台超过100万亿Token使用数据的实证分析，揭示了2025年AI行业的发展趋势，核心结论包括开源与闭源模型关系转变为互补、中国开源模型力量崛起、模型功能向推理与执行系统演进、编程与角色扮演成为主要应用场景以及用户留存呈现“水晶鞋效应”等[1][8][12] 开源与闭源模型格局演变 - 开源模型不再是闭源模型的廉价替代品，两者关系已演变为互补，开发者常同时使用两类模型[9][10] - 开源模型使用量稳步增长，预计到2025年底将占据约三分之一的Token用量[10][12] - 开源模型市场从高度集中走向多元化，早期DeepSeek V3和R1曾占一半以上用量，但预计到2025年底，没有单一模型能持续占比超25%，市场将由5~7个模型均分[16][17][18] - 中型模型（参数在150亿到700亿之间）更受市场青睐，小模型正在失宠，市场分化为强大的中型模型类别或整合到最强大的单个大型模型上[20][21] 中国开源模型崛起 - 中国开源模型成为增长主要引擎，其每周Token使用量占比从2024年底的1.2%最高激增至30%，平均占比为13%，与其他地区开源模型平均13.7%的份额相当[12][13] - 中国模型如DeepSeek、MiniMax、Kimi K2等在开源领域受到青睐，其中DeepSeek在角色扮演和闲聊领域有极高粘性，超过三分之二的流量用于此[1][16][50] - 在编程领域，中国模型如MiniMax已成为快速崛起的新秀，近几周取得显著增长[48] 模型功能与使用范式转变 - 语言模型正从对话系统升级为推理与执行系统，使用推理功能的Token用量从年初可忽略不计增长至超过50%[22] - 模型调用工具的功能使用占比上升，从年初集中于少数模型发展到更多模型支持，缺乏可靠工具的模型有落后风险[29][30][31][33] - 用户任务复杂度提升，从生成短文转向解决难题，如分析完整文档或代码库[35] - 用户平均每次提示词长度增加约4倍，模型完成任务所需Token用量增加近3倍，反映出工作负载更依赖上下文且推理消耗更多[36][39] - AI正从聊天机器人转变为能独立规划步骤、调用工具并完成复杂目标的自动智能体（Agent）[42][43] 主要应用场景与模型偏好 - 编程和角色扮演是AI模型最主要的使用方式[12][44] - 编程查询的Token用量从年初的11%上涨至最近的超过50%，增长最为稳定[45] - 在编程领域，Claude系列长期占据主导地位，大部分时间占比超过60%，但其份额在2025年11月首次跌破60%[47] - OpenAI在编程领域的市场份额从2025年7月的约2%增长至近几周的约8%，谷歌份额稳定在约15%[47][48] - 在角色扮演领域，开源模型中其使用量占比高达52%，中国与西方开源模型在该领域平分秋色[50] 用户行为与留存特征 - 用户留存呈现“水晶鞋效应”，即新模型发布时若能完美解决特定用户痛点，便能锁定一批高粘性用户，即使后续有更好模型也难以被替换[12][67] - 例如，Claude 4 Sonnet和Gemini 2.5 Pro发布5个月后用户留存率仍保持40%高位[67] - 该效应窗口期很短，仅在模型被视为“最前沿”时有效，一旦竞品能力赶超则难以吸引新用户[69][70] - 用户留存模式可分为：成功锁定（如Claude、GPT-4o Mini）、从未合脚（如Gemini 2.0 Flash）、回旋镖效应（用户离开后因性价比或特定能力又回归，如DeepSeek）[74] 市场与区域动态 - AI不再是硅谷独角戏，亚洲地区付费使用量占比从13%翻倍至31%[71] - 北美仍是最大市场，但份额已不足50%[80] - 英语以82%的份额占据绝对主导，简体中文以近5%的份额位居第二[80] 其他关键发现 - 模型价格下降对使用量的影响有限，价格下降10%仅带来0.5%-0.7%的使用量增长[80] - 存在“杰文斯悖论”现象，即模型降价且好用后，用户会在更多场景更频繁地调用，导致总Token用量飙升，总支出可能并未降低[75][76] - 报告数据主要反映开发者与服务端API调用行为，未涵盖通过App或Web直接访问的流量，且平台定价策略可能影响数据代表性[76]