Cerebras InferenceCerebras Inference
全球最快 AI 芯片晶圆级推理引擎,生成速度超 1800+ tokens/秒,每天免费提供 100 万 Tokens!
核心免费额度
100 万 Tokens / 天每日刷新
每日免费刷新 100 万 Tokens,推理速度高达 1800+ tokens/秒,极客体验极佳。
刷新周期:每日刷新
申领条件与风控要求
手机验证免绑手机
信用卡绑定免绑信用卡
网络环境全球直连
并发限制RPM 无特殊限制 · TPM 无限制
免费可用模型
llama3.1-8bllama3.1-70b
10 秒快速接入代码
from openai import OpenAI
# 1. 初始化客户端(使用 Cerebras Inference 专属 API 接口地址)
client = OpenAI(
api_key="YOUR_API_KEY", # 填入申请到的 Cerebras Inference API Key
base_url="https://api.cerebras.ai/v1"
)
# 2. 发起对话请求(使用官方免费支持的模型)
response = client.chat.completions.create(
model="llama3.1-8b",
messages=[
{"role": "user", "content": "你好!请用一句话介绍你自己。"}
]
)
print(response.choices[0].message.content)curl https://api.cerebras.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer YOUR_API_KEY" -d '{
"model": "llama3.1-8b",
"messages": [{"role": "user", "content": "你好!"}]
}'import OpenAI from "openai";
// 1. 初始化客户端
const openai = new OpenAI({
apiKey: "YOUR_API_KEY",
baseURL: "https://api.cerebras.ai/v1",
});
// 2. 发起请求
const response = await openai.chat.completions.create({
model: "llama3.1-8b",
messages: [{ role: "user", content: "你好!" }],
});
console.log(response.choices[0].message.content);避坑提示与风控防范
- 免费层限制 30 RPM,速度极快适合 Agent 工具快速决策。
