位置:首页 > 产业资讯 > SpaceXAI发布新一代Grok 4.5旗舰大语言模型

SpaceXAI发布新一代Grok 4.5旗舰大语言模型

时间:2026-07-21  |  作者:318050  |  阅读:0

Grok 4.5 最近在圈子里热度不低。很多开发者都在问它到底值不值得上手。我们不妨先捋清几个关键点,再深入聊聊它的技术底子和实际表现。

Grok 4.5 是什么

Grok 4.5 是 SpaceXAI(原 xAI)最新推出的旗舰大语言模型,基于 1.5 万亿参数 的 V9 基础架构。在补充训练阶段,它深度整合了 Cursor 编程数据,代码生成和软件工程能力因此相当抢眼。

马斯克将其定位为 Opus 4.7 级别,主打更快的推理速度、更高的 token 效率以及更低的使用成本。第三方评测中,它在 GDPval-AA v2 基准上排名全球第四,目前已经对公众开放。

SpaceXAI发布新一代Grok 4.5旗舰大语言模型_wishdown.com

Grok 4.5 的主要功能

  • 智能代码生成——得益于 Cursor 编程数据的深度训练,它支持代码补全、Bug 修复、项目重构,还能自动生成测试用例。
  • 多步骤工程任务处理——跨文件依赖分析、架构设计、技术文档生成,这些长程软件工程流程它都能应对。
  • 智能体异步执行——支持长时间运行的 AI Agent 任务,适合复杂多轮决策和办公自动化流程。
  • 极速推理输出——每秒 80 token 的生成速度,响应延迟低,实时交互场景下表现流畅。
  • 多语言编程支持——在 SWE-Bench Multilingual 等基准中成绩不错,跨语言代码理解和转换能力突出。
  • 平台原生集成——已嵌入 Grok Build 对话平台和 Cursor IDE,开发者无需切换环境就能直接调用。
  • 标准 API 接入——通过 SpaceXAI 控制台提供 OpenAI 兼容接口,方便企业级系统集成和批量调用。

Grok 4.5 的技术原理

架构规模

基于全新 1.5 万亿参数 V9 基础架构,相比前代大幅提升了模型容量和表达能力。

数据工程

训练数据经过严格去重、质量评分和领域筛选。并专门引入 Cursor 编程数据作为补充训练集,针对性强化代码理解和生成能力。

训练基础设施

采用数万块英伟达 GB300 GPU 进行大规模训练,搭配稳定运行技术保证长时间训练不中断。

强化学习优化

覆盖数十万个多步骤软件工程任务。通过支持长时间运行的智能体异步训练,提升模型在复杂长程任务中的推理效率。

推理效率

优化解码策略和推理路径规划。SWE Bench Pro 任务平均仅消耗 15954 个 token,约为同类顶尖模型的四分之一,速度与成本双双压缩。

如何使用 Grok 4.5

  • 通过 Grok Build 使用——直接登录 Grok Build 平台,在对话界面选择 Grok 4.5 模型即可进行日常问答、代码编写和文档处理。
  • 通过 Cursor 编译器使用——Grok 4.5 已集成进 Cursor 编程环境,开发者在 IDE 内就能调用模型进行代码补全、Bug 修复和项目重构,编程工作流无缝嵌入。
  • 通过 API 调用——登录 SpaceXAI 控制台获取 API 密钥,按照标准 OpenAI 兼容接口格式接入,适合定制化需求。

Grok 4.5 的核心优势

  • 性能对标顶尖梯队——内部评估与 Opus 4.7 大致相当,Terminal-Bench 2.1 得分 83.3%,已经跻身大模型第一梯队。
  • 极致成本优势——GDPval-AA v2 单项任务成本仅 0.49 美元,比排名前三的模型便宜近 90%,低于 GLM-5.2 和 Kimi K2.6。
  • Token 效率领先——SWE Bench Pro 任务平均消耗 15954 token,比 Opus 4.8 的 67020 token 减少 4.2 倍,直接降低用户实际支出。
  • 推理速度极快——输出速度达每秒 80 token,达到快速模型运行标准,长程任务响应更及时。
  • 工程能力突出——在 DeepSWE 1.0SWE-Bench Pro 等软件工程基准中表现优异,经过 Cursor 数据强化,代码生成与多步骤工程任务处理能力非常显著。

Grok 4.5 的项目地址

  • 项目官网:https://x.ai/news/grok-4-5

Grok 4.5 的同类竞品对比

对比维度 Grok 4.5 Claude Opus 4.8
Terminal-Bench 2.1 83.3% 78.9%
SWE-Bench Multilingual 78.0% 84.4%
DeepSWE 1.0 62.0% (high) 55.8% (max)
SWE-Bench Pro 64.7% (high) 69.2% (max)
GDPval-AA v2 Elo 1543(全球第四) 1600(前三)
任务成本 $0.49/任务 约 $5-10/任务
Token 效率 15954 token/任务 67020 token/任务
输出速度 80 token/秒 较慢
API 输入价格 $2/百万 token 更高
API 输出价格 $6/百万 token 更高
核心定位 高性价比工程模型 极致性能旗舰模型

Grok 4.5 的应用场景

  • 智能软件开发——在 Cursor 等 IDE 中辅助代码补全、Bug 诊断、项目重构与自动化测试生成,适合全栈开发和大型代码库维护。
  • 多步骤工程任务——处理复杂的长程软件工程流程,比如跨文件依赖分析、架构设计和技术文档自动生成。
  • 企业级 API 集成——通过 SpaceXAI 控制台接入内部系统,构建低成本、高吞吐的客服机器人、数据分析与业务流程自动化工具。
  • 终端编程辅助——在 Grok Build 平台中快速生成脚本、查询命令与配置文件,运维工程师和数据科学家能借此提升日常效率。

来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多