← DevlyAPI

Devly API Documentation

Документация

OpenAI-compatible API с короткими Devly-именами моделей.

BASE URLhttps://devlyapi.vercel.app/v1

Аутентификация

Для API-запросов нужен ключ из Dashboard. Передавайте его как Bearer token.

Authorization header
Authorization: Bearer devly_sk_...

Chat Completions

Основной endpoint — POST/v1/chat/completions. Формат запроса совместим с OpenAI Chat Completions.

cURL
curl https://devlyapi.vercel.app/v1/chat/completions \
  -H "Authorization: Bearer $DEVLY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "GPT-6 Luna",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'

Модели

В публичном API используются только короткие имена моделей.

Inkling0.45×

Простое общение

Inkling-Small0×

Автономная техподдержка и автоматизация

Nemotron-3.5-Lightning0×

Агентские задачи и автономная техподдержка

DeepSeek-V4.1-Flash0.75×

Быстрая модель DeepSeek для общего использования и агентских задач

Space Bunny0.65×

Универсальная модель Space Bunny

GLM 5.3 Flash0.85×

Эффективная модель GLM для кодинга, общего использования и агентских задач

GPT-6 Luna1×

Быстрая GPT-6 модель для массовых и повседневных задач

GPT-6.1 Sol1.55×

Продвинутая GPT-6 модель для кодинга, сложных задач и рассуждений

JavaScript

Node.js / fetch
const response = await fetch(
  "https://devlyapi.vercel.app/v1/chat/completions",
  {
    method: "POST",
    headers: {
      "Authorization": "Bearer " + process.env.DEVLY_API_KEY,
      "Content-Type": "application/json"
    },
    body: JSON.stringify({
      "model": "Qwen-3.8-27B",
      "messages": [{ role: "user", content: "Hello!" }]
    })
  }
)

const data = await response.json()

Python

Python / requests
import requests

response = requests.post(
    "https://devlyapi.vercel.app/v1/chat/completions",
    headers={"Authorization": f"Bearer {DEVLY_API_KEY}"},
    json={
        "model": "Qwen-3.8-27B",
        "messages": [{"role": "user", "content": "Hello!"}]
    }
)

print(response.json())

Ответ

Успешный ответ возвращается в OpenAI-подобном JSON-формате. Поле usage используется для расчёта списания.

200 OK · application/json
{
  "id": "gen-...",
  "object": "chat.completion",
  "choices": [...],
  "usage": {
    "prompt_tokens": 123,
    "completion_tokens": 45,
    "total_tokens": 168
  }
}

Биллинг

100 000 токенов = 0,50 ₽. Множитель модели применяется к фактическому usage. Например, модель с множителем 0.65 списывает примерно 65% от usage.

Ошибки

400Некорректный запрос или модель недоступна.
401API key отсутствует или неверен.
402Недостаточно токенов.
5xxОшибка Devly или upstream-провайдера.

Примечание

Сейчас endpoint работает без streaming: запросы с "stream": true отклоняются. Поддержка streaming будет добавлена отдельно.