Cerebras Inference
World's fastest wafer-scale inference engine (1800+ tokens/s). 1,000,000 free tokens daily.
Core Free Tier
100 万 Tokens / 天每日刷新
每日免费刷新 100 万 Tokens,推理速度高达 1800+ tokens/秒,极客体验极佳。
Reset Cycle: 每日刷新
Eligibility & Verification Requirements
Phone VerificationNo Phone Needed
Credit CardNo Card Needed
Network / RegionGlobal Direct
Concurrency RateStandard Tier
10-Second Drop-in Integration Code (OpenAI Compatible)
curl https://api.cerebras.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer YOUR_API_KEY" -d '{
"model": "llama3.1-8b",
"messages": [
{"role": "user", "content": "Hello!"}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.cerebras.ai/v1",
api_key="YOUR_API_KEY",
)
response = client.chat.completions.create(
model="llama3.1-8b",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.cerebras.ai/v1",
apiKey: "YOUR_API_KEY",
});
const response = await client.chat.completions.create({
model: "llama3.1-8b",
messages: [{ role: "user", content: "Hello!" }],
});
console.log(response.choices[0].message.content);Gotchas & Risk Precautions
- 免费层限制 30 RPM,速度极快适合 Agent 工具快速决策。
