中信证券:xAI发布Grok-3,诠释“大力出奇迹”

近期xAI发布Grok-3系列模型,作为全球首个在十万卡集群上训练的大模型,Grok-3应用了合成数据、强化学习、自我纠错机制、人类反馈循环和上下文训练等方法,模型综合能力较前代模型Grok-2提升显著。据xAI官方测评数据,在数学测试、理科测试和代码测试中,Grok-3 Reasoning性能表现超越了o3 mini(high)、Gemini-2 flash thinking和DeepSeek R1等头部模型。Grok-3系列模型的SOTA表现,意味着算力堆积仍是模型进步的关键变量之一。中信证券判断产业在追逐AGI模型的方向上有望不断加速,进而对算力需求形成持续拉动,同时主要模型厂商在复杂推理层面的不断加码,亦有望推动下游应用的不断解锁,从而在中期构建更为健康、均衡的AI产业生态。

事项:

北京时间2月18日中午12点,马斯克创立的大模型初创公司xAI发布了其最新一代大模型Grok-3以及其相关变体版本Grok-3 Reasoning、Grok-3 mini和Grok-3 mini Reasoning,引发资本市场高度关注。

根据xAI官方X平台账号,Grok-3是xAI基于其部署于田纳西州孟菲斯的Colossus超级计算机训练得到的,消耗的计算资源等效于2亿小时H100支持的GPU训练时长,是上一代模型Grok-2的10倍以上。根据xAI官网,Colossus超级计算机至少包含10万张H100,由此中信证券预计预训练阶段消耗时长超2000小时(83.3天)。

此外在发布会上,马斯克还宣布在Grok-3成熟稳定后(马斯克预计几个月之后),xAI发布的上一代模型Grok-2将开源。根据xAI官网,在2024年Grok-2发布后,xAI也以Apache2.0开源协议了总参数规模达3140亿的MoE大模型Grok-1。

模型效果与实现机理:算力堆积、强化学习等显著提升模型综合、推理能力。

作为全球首个在十万卡集群上训练得到的大模型,Grok-3测评结果亮眼,在多项测试中均处于行业领先地位。

根据xAI发布会,在数学测试AIME、博士水平理科测试GPQA和代码编写测试Coding(LCB Oct-Feb)中Grok-3得分分别为52/75/57,性能表现超越了Gemini-2 Pro、DeepSeek V3、Claude 3.5 Sonnet和GPT-4o等主流模型;Grok-3 Reasoning得分分别为93/85/79,性能表现超越了o3 mini(high)、Gemini-2 flash thinking和DeepSeek R1等头部推理模型。而在Chatbot Arena这一评估AI模型受人类欢迎程度的测试中,Grok-3的早期版本得分达到了1402,高于Gemini 2.0 flash think、GPT-4o、DeepSeek R1和o1等头部大模型。

根据xAI官方X平台账号,中信证券认为Grok-3的性能优秀的成因有以下2点:1)庞大的算力投入带来了模型能力的涌现,根据xAI发布会,Colossus超级计算机在完成第二阶段建设后集群规模扩展至20万张H100;2)合成数据、强化学习、自我纠错机制、人类反馈循环和上下文训练等训练手段的应用。

市场定位:面向付费用户,能力提升有望解锁更多潜在场景,成本有待优化。

根据xAI发布会,目前Grok-3将率先于推特的Premium Plus用户中推广,该订阅计划目前每月订阅费用为40美元。同时,xAI还发布了由Grok模型支持的Agent产品DeepSearch。该Agent产品能通过扫描互联网和推特来获得并分析信息,最终总结回复。根据xAI发布会,DeepSearch和无限的图像生成功能将包含在SuperGrok这项独立收费计划中,预计订阅费用为每月30美元(年度订阅为300美元)。此外,Grok-3的企业级API预计将在几周后上线。在xAI发布会中,官方还展示了如何用Grok自动化游戏开发。中信证券认为模型能力的不断提升下,AI应用场景有望进一步解锁;而对比Grok-3与的ChatGPT的定价水平(20美元/月),并考虑到目前仍处于市场教育抢占份额阶段,中信证券认为Grok-3的推理成本有待进一步优化。

趋势展望:基础模型演进节奏加快,合成数据&强化学习等值得持续关注。

根据IBM和MIT研究者的论文《A Hitchhiker’s Guide to Scaling Law Estimation》(Choshen,Zhang和Andreas,2024),理论上来看现阶段预训练Scaling Law依旧有效。而根据各公司官网,2024年Inflection、Adept和Character AI等海外明星模型初创公司均已放弃预训练,并将重心转向后训练与推理技术(如Agent技术等)。

中信证券认为该变化主要成因有如下2个方面:1)万卡乃至十万卡级别算力集群投入过高:根据Pytorchtoatoms官网的测算,Meta于2024年3月推出的4.9万卡算力集群建设+4年运营成本达到了12.87亿美元;2)高质量数据匮乏:根据2024年NIPS会议上AI科学家伊利亚演示材料,预训练在未来或将受限于互联网数据耗尽。但Grok-3的出现不仅在实践上证明了现阶段预训练Scaling Law依旧有效,也表明了合成数据和强化学习技术的重要性。由此中信证券预计少数头部公司仍将继续加大预训练投入,并在合成数据和强化学习上进行更多探索。

风险因素:

AI核心技术发展不及预期风险;科技领域政策监管持续收紧风险;私有数据相关的政策监管风险;全球宏观经济复苏不及预期风险;宏观经济波动导致欧美企业IT支出不及预期风险;AI潜在伦理、道德、用户隐私风险;企业数据泄露、信息安全风险;行业竞争持续加剧风险等。

投资策略:

本次Grok-3模型的发布仍然是围绕底层算法层面,尤其是大语言模型的综合、推理能力。从技术角度,Grok-3的性能表现在庞大算力、多种训练手段加持下得到显著提升,体现了头部公司在基础模型+推理能力两个方向的持续聚焦。应用层面,尽管Grok-3的成本在短期可能限制了其应用场景的开阔,但是随着工程能力的进步和底层算法能力提升带来的通用推理能力的进步,中信证券认为AI爆款应用有望从科研、编程等高价值场景起率先解锁,软件、互联网有望率先受益。除去应用端的投资机会,硬件端的需求也必然会随着多模态的技术进步而不断提高,中信证券仍然持续看好AI算力层面,尤其是得益于商业端逐步成熟而带来的更多的AI推理侧算力的机会。

注:本文节选自中信证券研究部已于2025年2月19日发布的《前瞻研究全球AI人工智能产业重大事项点评—xAI发布Grok-3,诠释“大力出奇迹”》报告,分析师:陈俊云S1010517080001;许英博S1010510120041;贾凯方S1010522080001;高飞翔S1010523060003

主题测试文章,只做测试使用。发布者:北方经济网,转转请注明出处:https://www.hujinzicha.net/5683.html

(0)
北方经济网的头像北方经济网
上一篇 2025年3月25日 下午3:07
下一篇 2025年3月25日

相关推荐

  • 隔夜美股全复盘(3.7) | 纳指大跌2.6%,英伟达创6个月新低

    01 大盘 昨夜美股三大股指集体收跌,纳指大跌2.6%,英伟达创6个月新低。截至收盘,道指跌 0.99%,纳指跌 2.61%,标普跌 1.78%。美国十年国债收益率跌 0.093%,收报4.278%,相较两年期国债收益率差31.5个基点。恐慌指数VIX涨 13.41%至24.87,布伦特原油收涨 0.09%至69.44。现货黄金昨日跌 0.29%,报2910…

    2025年3月25日
    4200
  • 华尔街13F持仓大揭秘!“美股七巨头”投资分歧加剧,股神狂砍银行股

    近期,华尔街金融机构陆续向美国SEC提交最新13F表。 整体来看,投资巨鳄们对美国科技股的分歧正在加大,但对加密货币似乎青睐有加。 其中,贝莱德、景顺继续加码科技巨头,桥水、巴克莱、文艺复兴科技等则在大幅减持。另外巴克莱、高盛、贝莱德等还加码押注了比特币投资。 股神巴菲特则继续大举抛售银行股,不过并未再减持苹果。 “股神”继续砍仓银行股 美东时间2月14日,…

    商业 2025年3月25日
    7400
  • 巨变!3000亿龙头停牌!

    业绩期基本告一段落,近期市场情绪明显回落,短期呈现波段调整的特征。 周一A股市场低开冲高后再度回落,随后低位窄幅震荡。 截止收盘,上证指数微跌0.05%,创业板指跌0.8%,上周大跌的北证50有所回暖。全市场成交额逾1万亿元,约3800只个股上涨。 上周末的一则公告,在芯片和算力圈中引发巨震。 到底发生了什么? 01、重大合并!逆势飙涨! 板块方面,发电设备…

    2025年5月26日
    4000
  • 特朗普关税是否存在预期差?

    我们认为4月或将是特朗普关税政策落地最为密集的时间点,4月初《美国优先贸易政策备忘录》调查结果与“对等关税”的出台将是关键节点。基于新总统“蜜月期”和中期选举准备期的历史规律,我们认为特朗普计划中的理想政策路径应是短期内让负面政策快速落地,保持较高容忍度,随后冲击逐步收敛,并推出减税等正面政策,确保经济在二季度逐步回暖,年底前回归强势。我们认为,“对等关税”…

    商业 2025年3月25日
    3900
  • 给富人看病的卓正医疗冲击港股IPO,2023年之前持续亏损

    最近几个交易日,医药行业终于扬眉吐气了一把,在恒生指数连续下挫的行情中,康宁杰瑞-B、和铂医药-B、翰森制药、康方生物等医药个股却逆势上涨。 消息面上,近日一份《进一步优化药品集采政策的方案(征求意见稿)》内容在业内流传,意在优化药品集采方案。根据这份文件,对于现有的不少品种而言,未来支付端可能会有所松绑,由此也带动了二级市场的情绪。 与此同时,一家专注于高…

    2025年3月29日
    5100

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

联系我们

400-800-8888

在线咨询: QQ交谈

邮件:admin@example.com

工作时间:周一至周五,9:30-18:30,节假日休息

关注微信