全部模型
Meta·快速可用

Llama 3.3 70B

meta-llama/llama-3.3-70b

可靠的聊天与 RAG 主力模型

快速工具
输入
US$0.11

每 100 万 token

输出
US$0.34

每 100 万 token

典型回复
≈ US$0.00028

输入 1k token,输出 500

上下文
128K

上下文

速度
120 tok/s

*

首 token 延迟
0.5 秒

*

* 速度和延迟为近似值。

如何使用

在任何兼容 OpenAI 的请求中,把模型 ID 填入 model 字段即可。

curl https://harvanera.com/v1/chat/completions \
  -H "Authorization: Bearer sk-harvanera-YOUR_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/llama-3.3-70b",
    "messages": [{"role": "user", "content": "Hello! What can you do?"}]
  }'

请将 sk-harvanera-YOUR_KEY 替换为「API 密钥」页面中的密钥。

相似模型