直连通道
官方直连链路,适合需要原生体验与完整上下文的请求。
| 输入 | 输出 | 缓存命中 |
|---|---|---|
| 2.00/M | 6.00/M | 0.50/M |
同一模型能力,多条服务通道;按延迟、稳定性与成本灵活选择。
价格单位:$ / 1M tokensprovider 字段,例如 "provider": { "channel": "direct" }。可选 direct / stable / economical;不传则使用默认通道。官方直连链路,适合需要原生体验与完整上下文的请求。
| 输入 | 输出 | 缓存命中 |
|---|---|---|
| 2.00/M | 6.00/M | 0.50/M |
Grok 4.6 是 xAI 于 2026 年 8 月 12 日发布的旗舰模型,在 Grok 4.5 的基础上重点强化了长周期智能体和交互式视觉工程能力。它在 Artificial Analysis 智能指数上拿到 61 分,与 GPT-5.6 Sol 持平,距离 Fable 5 Max 只差 1 分——而价格档位仍然保持 Grok 系一贯的低位。
Grok 4.6 不是全新的基座模型,而是在 Grok 4.5 约 1.5 万亿参数基座上,用精选工程数据和改进的强化学习做的一次增量训练。这次升级最直观的变化是:模型在长任务中开始主动自检——先验证自己的输出再继续推进,而不是一遍跑完就交差。
海鲸AI 通过 OpenAI 兼容接口提供 Grok 4.6,支持工具调用、流式输出与多模态输入。
获取 API 密钥 · 模型 ID:
grok-4.6
Grok 4.6 延续了 4.5 对"真实项目里长时间干活"的优化方向,并把重心进一步压在多步骤任务的坚持度上:研究一个课题、分析一批资料、跨代码库改动、把一个想法做成可用的应用,都能跨越大量步骤保持目标一致。
在真实职业任务评测上是当前的第一梯队:GDPval-AA v2、AA-Briefcase、Harvey 法律评测三项全部第一。法律、咨询、分析类的文档密集型工作是它优势最集中的场景。
这一代明显加强了"从粗略产品概念到可用原型"的能力,视觉与交互类项目的首轮产出质量更高,返工更少。
增量训练用了精选工程数据,编码基准全面上涨:DeepSWE v1.1 65.9%(4.5 为 54%)、CursorBench 3.2 69.9%、FrontierCode v1.1 61.3%。覆盖场景从常规开发延伸到内核优化和 CAD 环境。
| 场景 | 说明 |
|---|---|
| 知识工作自动化 | GDPval-AA v2 等真实职业任务评测的当前第一 |
| 法律与合规分析 | Harvey 法律评测冠军,文档密集型任务优势明显 |
| 长周期编码智能体 | 跨大量步骤的代码库级改动,自检减少跑偏 |
| 原型快速落地 | 从产品概念直出可交互的功能原型 |
| 深度研究 | 50 万 token 上下文配合多步骤研究流程 |
| 成本敏感的生产部署 | 前沿能力配 Grok 系的价格档位 |
| 能力 | Grok 4.6 | Grok 4.5 | GPT-5.6 Sol |
|---|---|---|---|
| 模型 ID | grok-4.6 |
grok-4.5 |
gpt-5.6-sol |
| 厂商 | xAI | xAI | OpenAI |
| AA 智能指数 | 61 | 56 | 61 |
| DeepSWE v1.1 | 65.9% | 54% | 更高(该项领先) |
| GDPval-AA v2 | 1753(第一) | — | 落后于 Grok 4.6 |
| 上下文窗口 | 50 万 token | 50 万 token | 100 万+ token |
| 输入模态 | 文本 + 图像 | 文本 + 图像 | 文本 + 图像 |
具体计费以页面上方的实时价格卡片为准。
Grok 4.6 什么时候发布的? 2026 年 8 月 12 日发布。
和 Grok 4.5 比升级了什么? 三块:一是智能指数从 56 提到 61,编码基准全面上涨(DeepSWE 从 54% 到 65.9%);二是知识工作评测拿下三项第一;三是长任务中出现了主动自检行为,先验证再推进。它是 4.5 基座上的增量训练,不是新基座。
有落后的地方吗? 有。DeepSWE v1.1 和 Terminal-Bench 3.0 两项输给 GPT-5.6 Sol——纯代码执行类基准上 Sol 仍略占优,但 Grok 4.6 的价格档位低得多。
上下文窗口多大? 50 万 token,支持文本和图像输入,输出为文本。
适合拿它做什么? 最能体现差距的是两类任务:文档密集的专业知识工作(法律、分析、研究),以及需要跨很多步骤的智能体流程。短小的一次性问答体现不出它与上一代的差别。
推理模式怎么用? Grok 4.6 提供显式推理模式,复杂任务下开启可以获得更完整的推理链路,简单任务不开可以省 token。
grok-4.6https://api.seawhaleai.com/v2/"provider": { "channel": "direct" }海鲸AI 兼容 OpenAI 接口协议,可直接使用 OpenAI SDK 或 HTTP 请求接入,默认开启流式输出。
关于 provider 参数(可选,海鲸AI 扩展字段):同一模型通常有多条服务通道,价格与稳定性略有差异。在请求体中加入 provider 字段即可指定通道;不传该字段时由系统自动选择默认通道,不影响正常调用。
provider并非 OpenAI 官方协议中的字段,而是海鲸AI 的扩展参数,仅在本平台生效。OpenAI SDK 允许透传此类自定义字段,用法见下方示例。
| 取值 | 通道 | 适用场景 |
|---|---|---|
direct | 直连通道 | 官方直连链路,追求原生体验与完整上下文 |
stable | 优选通道 | 兼顾可用性、速度,适合日常生产调用 |
economical | 特惠通道 | 成本优先,适合批量处理与价格敏感业务 |
具体通道与对应价格以上方「定价」为准(各模型开通的通道可能不同)。补充说明:
"provider": { "channel": "direct" }。extra_body 传入;Node.js 直接写在请求对象中即可透传,TypeScript 项目加一行 // @ts-expect-error 跳过类型检查。curl https://api.seawhaleai.com/v2/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer <API_KEY>" \
-d '{
"model": "grok-4.6",
"messages": [
{"role": "system", "content": "你是一个有帮助的助手。"},
{"role": "user", "content": "你好!"}
],
"provider": { "channel": "direct" },
"stream": true
}'
# provider 为可选字段,删除该行即使用默认通道from openai import OpenAI
client = OpenAI(
base_url="https://api.seawhaleai.com/v2",
api_key="<API_KEY>",
)
stream = client.chat.completions.create(
model="grok-4.6",
messages=[
{"role": "system", "content": "你是一个有帮助的助手。"},
{"role": "user", "content": "你好!"},
],
stream=True,
# 可选:指定服务通道,不传则使用默认通道
extra_body={"provider": {"channel": "direct"}},
)
for chunk in stream:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)import OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.seawhaleai.com/v2',
apiKey: '<API_KEY>',
})
const stream = await client.chat.completions.create({
model: 'grok-4.6',
messages: [
{ role: 'system', content: '你是一个有帮助的助手。' },
{ role: 'user', content: '你好!' },
],
stream: true,
// 可选:指定服务通道,不传则使用默认通道
// @ts-expect-error provider 为海鲸AI 扩展字段,不在 OpenAI SDK 类型定义内
provider: { channel: 'direct' },
})
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? '')
}