Groq LPU 极速推理Groq LPU Acceleration
基于自研 LPU 架构的全球极速推理平台,生成速度超 500-800 tokens/秒,永久提供免费层!
核心免费额度
永久免费层 30 RPM / 14,400 RPD永久免费
永久提供 30 RPM 与每日 14,400 次请求免费额度,极速体验极佳。
刷新周期:每日刷新
申领条件与风控要求
手机验证免绑手机
信用卡绑定免绑信用卡
网络环境全球直连
并发限制RPM 无特殊限制 · TPM 无限制
免费可用模型
llama-3.3-70b-versatilellama-3.1-8b-instantdeepseek-r1-distill-llama-70b
10 秒快速接入代码
from openai import OpenAI
# 1. 初始化客户端(使用 Groq LPU 极速推理 专属 API 接口地址)
client = OpenAI(
api_key="YOUR_API_KEY", # 填入申请到的 Groq LPU 极速推理 API Key
base_url="https://api.groq.com/openai/v1"
)
# 2. 发起对话请求(使用官方免费支持的模型)
response = client.chat.completions.create(
model="llama-3.3-70b-versatile",
messages=[
{"role": "user", "content": "你好!请用一句话介绍你自己。"}
]
)
print(response.choices[0].message.content)curl https://api.groq.com/openai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer YOUR_API_KEY" -d '{
"model": "llama-3.3-70b-versatile",
"messages": [{"role": "user", "content": "你好!"}]
}'import OpenAI from "openai";
// 1. 初始化客户端
const openai = new OpenAI({
apiKey: "YOUR_API_KEY",
baseURL: "https://api.groq.com/openai/v1",
});
// 2. 发起请求
const response = await openai.chat.completions.create({
model: "llama-3.3-70b-versatile",
messages: [{ role: "user", content: "你好!" }],
});
console.log(response.choices[0].message.content);避坑提示与风控防范
- 免费层受限于严格的 TPM 限制,适合单轮高频交互。
