xAI · 文本模型

Grok Build 0.1 API 中转

xAI 的实验版本型号,通过 island AI Coding 的 OpenAI 兼容接口中转调用,模型代号为 grok-build-0-1。目录标注 128K tokens 上下文实验版本标签,渠道目录参考价 $1/$3——用最低的成本为新技术方向投一张探索票。

更新日期:2026-09-01·模型代号:grok-build-0-1

1. Grok Build 0.1 是什么

Grok Build 0.1(grok-build-0-1)是 xAI 放出的实验性型号:目录明确标注实验版本,意味着它的能力边界与输出风格可能随迭代演进调整。

它的目录画像:

  • 128K tokens 上下文:聚焦短上下文的定向任务。
  • 能力标签:实验版本——官方对成熟度的如实标注。
  • $1/$3 每百万 tokens:Grok 系文本档的低价位,试错成本被压到最低。

2. 实验型号的正确打开方式

对待实验型号,站内建议遵循三条原则:

  • 只做增量尝试:用它验证新想法、新提示词结构是否值得投入,结论明确后再迁移到稳定旗舰固化收益;
  • 避开关键链路:生产核心业务不依赖实验型号——其行为变化不受兼容性承诺约束;
  • 记录对比数据:每次评估留下与稳定型号的对照样本,既积累选型依据,也帮助判断该方向何时值得转正。

三条原则的共同底色是:把不确定性圈定在评估环节——实验位的价值在于用最低成本回答「值不值得」,而不是替你承担生产环境的稳定性责任。

在站内的 Grok 4.6 页面系列对比中,Build 0.1 被归入面向编码自动化方向的实验位;具体胜任度请用自己的真实样本实测。

评估时建议带一张简易打分卡,避免「感觉还行」式的模糊结论:

评估维度记录内容
任务通过率同一批样本中可交付结果的比例
输出稳定性同提示词多次运行的波动程度
成本水位单位任务的 Token 消耗与对应费用
转正判断综合得分是否超过现役稳定型号的下限

3. 适用场景

新方向可行性探测

团队想验证「某个自动化环节能不能交给模型」时,先用最低价的实验票跑通概念验证。

提示词策略试验田

对同一批提示词做跨型号对照,观察不同训练取向下的行为差异,反哺主力型号的调优。

内部工具的玩具层

黑客松、内部小工具等容错度高的场合,用实验型号快速搭出能跑的原型;跑通之后再决定是否投入更贵的旗舰档做产品化。

回归基线的对照组

稳定型号升级换代时,保留一个固定提示词集在新旧两代各跑一轮——实验型号因价格低、迭代快,反而常被用作检验「代际进步幅度」的参照物。

4. API 最小示例

cURL · OpenAI 兼容调用
curl https://www.codex789.com/v1/chat/completions \
  -H "Authorization: Bearer sk-codex789-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-build-0-1",
    "messages": [
      {"role": "user", "content": "为这段构建脚本生成失败重试逻辑"}
    ]
  }'

Python SDK

Python · openai SDK
from openai import OpenAI

client = OpenAI(
    base_url="https://www.codex789.com/v1",
    api_key="sk-codex789-your-api-key",
)

resp = client.chat.completions.create(
    model="grok-build-0-1",
    messages=[{"role": "user", "content": "评审这条流水线的并行化改造思路"}],
)
print(resp.choices[0].message.content)

5. 价格与倍率说明

计费项说明
站内倍率0.1x,以控制台实时展示为准
渠道目录参考价$1 / $3 每百万 tokens(input/output),为公开目录信息
结算方式按 Token 用量 × 倍率结算,明细以控制台账单为准
成本定位Grok 系文本档低价位——实验与评估场景的低成本入口

6. 常见问题

Grok Build 0.1 的调用代号是什么?

调用代号为 grok-build-0-1,具体可用状态以控制台模型列表为准。

「实验版本」意味着什么?

这是目录对该型号的正式标注:能力边界与输出风格可能随版本演进而调整。它适合用于评估尝鲜与非关键链路,生产核心业务建议以稳定旗舰为主力;同时留意控制台公告,实验型号可能随时迭代或调整。

它适合用来做什么方向的尝试?

站内的 Grok 系对比中将其归入面向编码自动化方向的实验型号。具体胜任度因任务而异,建议用自己的真实样本小规模实测后再下结论。

生产环境的关键任务能用它吗?

不建议。关键业务应选择标注明确的现役旗舰(如 grok-4.6);实验型号的价值在于低成本试错,而非承载核心链路。

这一档怎么收费?

渠道目录参考价 $1/$3 每百万 tokens(input/output),为 Grok 系文本档的低价位,站内倍率 0.1x,明细见控制台账单。