curl https://cloudapi.vadi360.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-d '{
"model": "llama-3.1-405b",
"messages": [
{
"role": "user",
"content": "Merhaba!"
}
],
"temperature": 0.7,
"max_tokens": 1024
}' 兼容 OpenAI SDK · 即插即用替换
可用 模型
即刻访问最新最强大的开源模型。
Llama 3.1 405B
开源Meta
Params: 405B
Context: 128K
速度: 高
通用、推理任务
Mistral Large
企业级Mistral AI
Params: 70B+
Context: 32K
速度: 极快
商业智能、分析
Mixtral 8x22B
MoEMistral AI
Params: MoE 8x22B
Context: 64K
速度: 超快
多语言、编程
Qwen2.5-72B
多语言Alibaba
Params: 72B
Context: 128K
速度: 快
亚洲语言、数学
为什么选择 Vadi360 LLM API?
超低延迟
优化的推理流水线,首个 token 响应速度快。
可扩展 API
每秒可处理数千次请求。自主扩缩容与负载均衡。
数据安全
您的数据在土耳其境内处理,符合 KVKK 与 GDPR。
兼容 OpenAI 的 API
无需修改代码,即可迁移现有的 OpenAI 集成。
使用分析
在单一面板中追踪 token 消耗、响应时间与成本。
自定义模型托管
在专属 GPU 上托管您自己的微调模型。
简单 定价
按使用量付费,没有隐藏费用。
正在加载套餐…