Документация ApiClo
Выберите конкретную IDE или клиент: VS Code, Cursor, Trae, Claude Code, Codex и другие. Ниже сразу появятся правильный Base URL, модель и пошаговый гайд.
Выберите IDE и получите готовые настройки
Начните с приложения, которым уже пользуетесь. ApiClo покажет его endpoint, рекомендуемую модель и точный гайд — без поиска по всей документации.
Что вы хотите подключить?
Для автономной разработки начните с OpenCode, DeepSeek Harness или терминального CLI. Расширения редакторов остаются ниже.
Подключите Codex CLI/IDE или Claude Code через конфиг для своей ОС.
Выбрать Codex или Claude Code OpenCodeГлавный быстрый путь для автономной работы с проектом, tools и изображениями через явный каталог моделей.
Настроить OpenCode DeepSeek HarnessПолный агентский интерфейс с custom provider, явной поддержкой image input и управлением моделями.
Настроить Harness Oh My PiРасширяемый power-user CLI: провайдеры, tools, LSP/DAP и явная модельная capability для изображений.
Настроить OMP OrcaУправляет несколькими уже настроенными CLI-агентами, отдельными worktree и параллельными задачами.
Настроить Orca Просто чатПишите в браузере, выбирайте модель в интерфейсе, используйте Free-модели только здесь, когда они доступны.
Открыть чат Hermes AgentДля задач с памятью, веб-контекстом, файлами и длинной работой внутри ApiClo.
Открыть Hermes Desktop BridgeСкачайте bridge, если IDE или агенту нужен локальный router, доступ к папкам и работа с файлами компьютера.
Скачать .exe CursorПодходит для chat/plan через custom base URL. Для полного coding-agent пути лучше Hermes, Cline, Kilo, Roo, Claude Code или Codex.
Настроить Cursor Свое приложениеOpenAI-compatible /v1 для SDK, backend, сервисов и прямых HTTP-запросов.
Открыть APIКуда вставлять URL и ключ
Короткая карта совместимости. Если клиент просит OpenAI-compatible URL, используйте /v1. Если Anthropic/Claude клиент сам добавляет /v1/messages, используйте root без /v1.
| Клиент | Лучший путь | Base URL / key | Модель | Статус |
|---|---|---|---|---|
| Web Chatобычный пользователь | Открыть чат в ApiClo | не нужен API key | выбор в интерфейсе | рекомендуем |
| Hermesагент в кабинете | Agents → Hermes | аккаунт ApiClo | выбор в интерфейсе | рекомендуем |
| OpenCodeуниверсальный старт для кода | opencode.json |
https://apiclo.com/v1sk-hub-... |
gpt-6-astracapabilities.input: text + image |
рекомендуем |
| DeepSeek Harnessтонкая настройка агентов | profiles/web/cordis.patch.yml |
https://apiclo.com/v1APICLO_API_KEY |
gpt-6-astrainput: text + image |
рекомендуем |
| Oh My PiOMP | ~/.omp/agent/models.yml |
https://apiclo.com/v1APICLO_API_KEY |
gpt-6-astrainput: text + image |
CLI |
| Orcaоркестрация | поверх настроенного CLI | настраивается в дочернем CLI | наследуется от исполнителя | ADE |
| Desktop Bridgeлокальный router | скачать Windows .exe | http://127.0.0.1:18441/v1ключ можно оставить любым client key |
из Fetch models | рекомендуем |
| Cline / Roo / KiloVS Code | OpenAI-compatible profile | https://apiclo.com/v1sk-hub-... |
claude-sonnet-5 |
рекомендуем |
| Claude CodeCLI | ANTHROPIC_AUTH_TOKEN |
https://apiclo.comsk-hub-... |
claude-sonnet-5 |
CLI |
| CodexCLI / IDE extension | ~/.codex/config.toml |
https://apiclo.com/v1APICLAUDE_API_KEY |
claude-sonnet-5 |
CLI |
| Cursorchat/plan | OpenAI-compatible | https://apiclo.com/v1sk-hub-... |
apiclo-gpt-5-6-sol |
ограничено |
| API / SDKHTTP | OpenAI SDK | https://apiclo.com/v1Authorization: Bearer sk-hub-... |
claude-sonnet-5 |
API |
ApiClo Desktop Bridge
Desktop Bridge ставьте только для локального router, доступа к папкам или разрешений Hermes. IDE и CLI настраивайте по отдельным инструкциям.
Дополнительный локальный router и мост разрешений к компьютеру для файлов и Hermes. Это не установщик конфигурации IDE.
Данные подключения
Эти значения используются почти во всех IDE и SDK. Для каждого проекта лучше создать отдельный ключ.
https://apiclo.com/v1
Для Cursor, Continue, Kilo, Codex, OpenCode, SDK и raw HTTP.
https://apiclo.com
Для Claude Code, raw Anthropic SDK и клиентов, которые сами добавляют /v1/messages.
sk-hub-...
Полный ключ показывается один раз на странице API Keys.
claude-sonnet-5
Сбалансированный платный route для чата и кода.
Free Opus/Sonnet/Fable/GPT aliases предназначены для веб-чата, когда промо-емкость доступна. Не вставляйте free-* модели в IDE, агентов и внешние API-клиенты: для них используйте платные model id ниже.
Отдельные model ID с суффиксами -1m и -1m-context больше не используются. Выберите обычный model ID из списка ниже: длинные сессии сохраняют контекст и при необходимости автоматически сжимаются.
Быстрый старт
Минимальный путь от регистрации до первого ответа в IDE или API.
- 1
Выберите свою ОС: Windows, macOS или Ubuntu/Linux. Команды установки и пути конфигурации ниже отличаются по системе.
- 2
Создайте аккаунт и пополните баланс. Один баланс работает для веб-чата, API, Telegram и управляемых агентов.
- 3
Откройте API Keys и создайте отдельный ключ для конкретной IDE или проекта.
- 4
Codex, Claude Code и остальные клиенты подключаются по отдельным готовым инструкциям ниже.
- 5
Для универсального старта с кодом выберите OpenCode; для тонкой настройки агентов — DeepSeek Harness; для расширяемого CLI с tools — Oh My Pi.
- 6
Для параллельных агентов и worktree используйте Orca поверх уже настроенного Codex, Claude Code, OpenCode или OMP. Сам Orca API key не заменяет.
- 7
Проверьте соединение коротким запросом: Ответь только OK. Затем проверьте чтение текущей папки без изменений файлов.
- 8
Отдельно прикрепите маленький PNG/JPEG и спросите, что на нём. Текстовый OK не доказывает, что клиент передал изображение в API.
- 9
Для длинных кодовых задач держите один ключ на проект, не переключайте модель без необходимости и чистите из контекста node_modules, dist, logs, dumps.
ApiClo принимает OpenAI image_url и Anthropic image blocks. Некоторые IDE и harness-клиенты считают неизвестную custom-модель текстовой и удаляют вложение до запроса. Поэтому capability нужно объявить в самом клиенте.
- OpenCode v2:
capabilities: { tools: true, input: [text, image], output: [text] }. Kilo:modalities: { input: [text, image], output: [text] }. - DeepSeek Harness / Oh My Pi / OpenClaw:
input: [text, image]у каждой модели. - Crush:
model add ... --supports-images true. - VS Code native:
vision: true. Continue: включите image input/vision в карточке модели вашей версии. - Claude Code / Codex: отдельный model capability обычно не нужен; прикрепите файл штатной кнопкой/командой и проверьте, что выбранная модель vision-capable.
- Aider:
/add image.png,/pasteили запуск с именем изображения. - Cline / Roo / Cursor / Trae / Goose / Open WebUI: выберите vision-capable custom model; если UI предлагает Supports images, Vision или Attachments — включите этот флаг.
- Orca: наследует поддержку изображений от запущенного дочернего CLI; сначала настройте vision в нём.
Не добавляйте image в capability текстовой модели: клиент отправит вложение, но upstream отклонит запрос. Для проверки используйте новую сессию, маленькое изображение и явный вопрос о видимом объекте или тексте.
IDE-агенты вроде Cline, Kilo, Roo и Continue часто отправляют системный промпт, схему tools, diff, терминал и список файлов. Это нормально для coding-agent режима, но такие запросы стоят дороже обычного чата.
- Для повседневного кода начинайте с Sonnet; Opus включайте для сложного reasoning, архитектурного ревью и трудных багов.
- Просите агента читать конкретные файлы и папки, а не весь проект. Не добавляйте node_modules, dist, logs, dumps, большие JSON/CSV и бинарные файлы в контекст.
- В Continue оставляйте maxTokens около 1800-4096 для обычного chat/edit/apply и повышайте только когда реально нужен длинный ответ.
- Для Hermes держите длинную работу в одном чате и не переключайте модель без причины: так лучше сохраняются память, кэш и история задачи.
В Continue, SDK, curl и raw OpenAI-compatible API используйте точный id из /v1/models: например claude-sonnet-5 или claude-opus-4-8. Не добавляйте apiclaude/ перед model id, если клиент просит именно model. Некоторые UI, например Kilo, могут показывать provider/model внутри своего интерфейса; это не всегда строка для прямого API.
VS Code плагины
Для Cline, Roo и Kilo по умолчанию выбирайте OpenAI-compatible profile с Base URL /v1. Anthropic Messages используйте только как native/advanced режим, если клиент явно работает через /v1/messages.
Cline
Подходит для автономных кодовых задач в VS Code. Можно подключить ApiClo двумя способами.
Вариант A: OpenAI Compatible
- 1
Установите Cline из VS Code Marketplace и откройте Settings / API Configuration.
- 2
API Provider выберите OpenAI Compatible.
- 3
Base URL укажите полностью с /v1: https://apiclo.com/v1.
- 4
API Key: ваш sk-hub ключ. Model ID: claude-sonnet-5 или claude-opus-4-8.
- 5
Сохраните профиль и сначала отправьте тест: Ответь только OK.
API Provider: OpenAI Compatible
Base URL: https://apiclo.com/v1
API Key: sk-hub-...
Model: claude-sonnet-5
Вариант B: Anthropic Messages для native режима
- 1
Если ваша сборка Cline требует Anthropic provider, включите Use custom base URL.
- 2
Custom Base URL: https://apiclo.com . Здесь не добавляйте /v1, Cline сам идет в /v1/messages.
- 3
API Key: ваш sk-hub ключ. Model: claude-sonnet-5 или claude-opus-4-8.
- 4
Если Anthropic native режим нестабилен, вернитесь к варианту A OpenAI-compatible.
Provider: Anthropic
Custom Base URL: https://apiclo.com
Model: claude-sonnet-5
После сохранения сначала отправьте: Ответь только OK. Второй тест: Посмотри текущую папку и скажи, есть ли README.md, ничего не меняй.
Изображения: выберите vision-capable модель и включите Supports images/Vision, если этот переключатель есть в вашей версии Cline. После изменения создайте новую задачу и приложите PNG вместе с текстовым вопросом.
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Roo Code
Roo Code использует почти такую же схему, как Cline, но профиль провайдера может называться иначе.
- 1
Установите Roo Code из VS Code Extensions и откройте панель Roo Code.
- 2
Создайте API key в ApiClo в разделе API Keys.
- 3
Откройте API Configuration / Provider / Profile.
- 4
По умолчанию выберите OpenAI-compatible профиль: Base URL https://apiclo.com/v1 и model id из списка ApiClo.
- 5
Anthropic + custom base URL https://apiclo.com без /v1 используйте только для native/advanced режима.
- 6
Сохраните профиль, проверьте OK и только потом запускайте задачу с файлами.
- 7
Второй тест: попросите Roo прочитать текущую папку и сказать, есть ли README.md, без изменений файлов.
OpenAI Compatible Base URL: https://apiclo.com/v1
Anthropic Custom Base URL: https://apiclo.com
Model: claude-opus-4-8
Изображения: в профиле модели включите Vision/Supports images, если поле доступно. Если Roo скрывает attachment до запроса, проверьте ту же модель через OpenCode или Harness с явной capability.
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Kilo Code
Для Kilo используйте Custom Provider. В отличие от Cline/Roo, Base URL обычно указывается с /v1.
- 1
Установите Kilo Code из VS Code Extensions и откройте Settings / API Configuration.
- 2
Получите sk-hub API key в ApiClo -> API Keys.
- 3
Создайте Custom Provider: Provider ID apiclaude, Display Name ApiClo.
- 4
Для Claude-моделей по умолчанию выберите Provider API: OpenAI Compatible и Base URL https://apiclo.com/v1.
- 5
Provider API: Anthropic Messages используйте только если Kilo явно должен работать в native Messages режиме.
- 6
Model ID: claude-sonnet-5, claude-opus-4-8 или claude-fable-5-1.
- 7
Сохраните provider и выполните два теста: Ответь только OK; затем прочитай список файлов проекта без изменений.
Provider ID: apiclaude
Provider API: OpenAI Compatible
Base URL: https://apiclo.com/v1
Model ID: claude-sonnet-5
Изображения: для custom model задайте attachment: true и modalities с input [text, image], output [text]. Без modalities неизвестная модель считается text-only.
"attachment": true,
"modalities": {
"input": ["text", "image"],
"output": ["text"]
}
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Continue
Continue настраивается через config.yaml. Дайте модели роли chat, edit, apply и summarize.
- 1
Установите Continue и откройте конфигурацию: Continue -> Settings -> Open config.yaml.
- 2
Сохраните старый config.yaml перед заменой, если там уже есть свои модели.
- 3
Вставьте блок ниже, замените YOUR_API_KEY на sk-hub ключ.
- 4
Перезапустите Continue или выполните Reload Window в IDE.
- 5
Проверьте chat, edit и apply на маленьком файле до тяжелой задачи.
~/.continue/config.yaml
name: ApiClo
version: 1.0.0
schema: v1
models:
- name: Claude Sonnet 5
provider: openai
model: claude-sonnet-5
apiBase: https://apiclo.com/v1
apiKey: YOUR_API_KEY
capabilities:
- tool_use
roles:
- chat
- edit
- apply
- summarize
defaultCompletionOptions:
temperature: 0
context:
- provider: code
- provider: docs
- provider: diff
- provider: terminal
- provider: problems
- provider: folder
- provider: codebase
ApiClo не задаёт в этом примере жёсткие contextLength или maxTokens. Continue использует возможности выбранной модели и показывает фактическую активную конфигурацию в Continue Console → Options.
В длинной Agent-сессии нажмите Compact conversation: значок со сходящимися стрелками под последним ответом. После заполнения 60% эта команда также доступна через индикатор контекста возле поля ввода. Continue сохранит техническую сводку и в следующих запросах отправит её вместе только с новыми сообщениями. Это сжатие истории, а не обрезка текущей задачи. После сжатия проверьте следующий запрос в Continue Console: в нём должна быть сводка и только новые ходы, а не сотни старых tool_result.
Если Continue ругается на provider: openai, используйте OpenAI-compatible/custom provider и те же apiBase/apiKey/model. Для model указывайте claude-sonnet-5 или claude-opus-4-8 без префикса apiclaude/.
Изображения: включите image input/vision в настройках выбранной custom-модели вашей версии Continue. Если такого поля нет, обновите Continue; текстовый запрос не проверяет передачу вложения.
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
VS Code native BYOK
Для встроенного Custom Endpoint в VS Code добавьте модели в пользовательский файл конфигурации.
- 1
Откройте папку User settings VS Code и создайте chatLanguageModels.json, если файла еще нет.
- 2
Вставьте JSON ниже и замените YOUR_API_KEY на sk-hub ключ.
- 3
Проверьте, что url заканчивается на /v1/chat/completions.
- 4
Выполните Developer: Reload Window.
- 5
В чате VS Code выберите Claude Sonnet 5 и отправьте тест Ответь только OK.
%APPDATA%\Code\User\chatLanguageModels.json
[
{
"name": "ApiClo",
"vendor": "customendpoint",
"apiKey": "YOUR_API_KEY",
"apiType": "chat-completions",
"models": [
{
"id": "claude-sonnet-5",
"name": "Claude Sonnet 5",
"url": "https://apiclo.com/v1/chat/completions",
"toolCalling": true,
"vision": true,
"maxInputTokens": 1000000,
"maxOutputTokens": 64000,
"streaming": true
},
{
"id": "claude-opus-4-8",
"name": "Claude Opus 4.8",
"url": "https://apiclo.com/v1/chat/completions",
"toolCalling": true,
"vision": true,
"maxInputTokens": 1000000,
"maxOutputTokens": 64000,
"streaming": true
}
]
}
]
Developer: Reload Window
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
IDE и desktop-клиенты
Клиенты с OpenAI-compatible настройками используют одну и ту же пару Base URL + API key.
Cursor
Используйте Cursor-safe ID, чтобы Cursor не заменял их встроенными моделями.
- 1
Откройте Cursor Settings → Models → API Keys и сохраните ключ ApiClo sk-hub в поле OpenAI API Key.
- 2
Включите Override OpenAI Base URL и укажите точно https://apiclo.com/v1.
- 3
Добавьте один из точных custom ID ниже. Они видны в /v1/models и используют тот же routing, fallback и биллинг, что исходная модель.
- 4
Выберите точный пункт apiclo-*, а не встроенный GPT-5.6 Sol или Claude от Cursor.
- 5
На macOS и Windows настройка одинаковая. Cursor Tab и другие специальные функции могут продолжать использовать модели Cursor.
- 6
Отправьте «Ответь только OK». Если запрос не появился в ApiClo Logs, обновите Cursor и проверьте, что выбрана custom-модель apiclo-*.
OpenAI Base URL: https://apiclo.com/v1
OpenAI API Key: sk-hub-...
Model: apiclo-gpt-5-6-sol
Выберите vision-capable custom-модель и включите Supports images / Vision / Attachments, если этот переключатель есть в вашей версии Cursor. Если custom-модель не показывает кнопку вложения, это ограничение клиента: используйте OpenCode, Harness, OMP или Crush с явным capability-флагом.
ApiClo поддерживает /v1/chat/completions и /v1/responses для этих ID. Если ошибка сохранится, отправьте поддержке новый Cursor Request ID и точное время UTC.
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Trae
Trae подключается через Settings -> Models -> Add Model -> Custom Config.
- 1
Установите Trae и войдите в аккаунт, иначе раздел Models может быть скрыт.
- 2
Откройте Settings -> Models -> Add Model -> Custom Config.
- 3
Для Claude выбирайте API Format Anthropic Messages, URL https://apiclo.com или https://apiclo.com/v1 если Trae просит полный /v1 endpoint.
- 4
Для OpenAI Completions используйте https://apiclo.com/v1 и model id claude-sonnet-5.
- 5
Вставьте API Key, сохраните модель и сделайте тест Ответь только OK.
- 6
Если Trae показывает пустой ответ, уменьшите max output и проверьте точный формат API Format.
API Format: OpenAI Completions
Custom Request URL: https://apiclo.com/v1
Model ID: claude-sonnet-5
Изображения: выберите vision-capable модель и включите multimodal/vision/attachments в Custom Config, если Trae показывает этот параметр. После сохранения обязательно отправьте отдельный image + text тест.
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Open WebUI / LibreChat
Подключайте ApiClo как OpenAI-compatible provider.
- 1
Откройте админ-настройки providers или env-конфигурацию вашего self-hosted UI.
- 2
Выберите OpenAI-compatible provider.
- 3
Укажите OPENAI_API_BASE_URL=https://apiclo.com/v1 и OPENAI_API_KEY=sk-hub-...
- 4
Добавьте DEFAULT_MODEL=claude-sonnet-5 или выберите модель в UI.
- 5
Перезапустите контейнер/процесс UI и отправьте короткий тест.
OPENAI_API_BASE_URL=https://apiclo.com/v1
OPENAI_API_KEY=sk-hub-...
DEFAULT_MODEL=claude-sonnet-5
Изображения: в Open WebUI или LibreChat включите vision capability у custom-модели/connection. Наличие API-маршрута само по себе не заставляет UI прикреплять файл.
Если интерфейс сам добавляет /v1, укажите root https://apiclo.com или уберите лишний /v1 в настройке.
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
CLI и терминальные агенты
Для CLI особенно важно не путать OpenAI-compatible и Anthropic-compatible переменные.
OpenCode v2
Рекомендуемый быстрый путь: custom provider хранится в opencode.json, а vision указывается в capabilities модели.
- 1
Установите OpenCode v2 по официальной инструкции: macOS/Linux — npm install -g @opencode/cli; Windows — standalone CLI binary с сайта OpenCode.
- 2
Создайте opencode.json в корне проекта и вставьте конфигурацию ниже.
- 3
Задайте APICLO_API_KEY в окружении процесса OpenCode; не записывайте ключ в конфиг проекта.
- 4
Объявите реальные capabilities каждой модели. OpenCode v2 предполагает text+image для неизвестной модели, но это допущение, а не проверка API.
- 5
Запустите opencode, проверьте короткий текстовый ответ, затем прикрепите маленький PNG/JPEG и попросите прочитать видимый текст.
macOS / Linux:
npm install -g @opencode/cli
{
"$schema": "https://opencode.ai/config.json",
"providers": {
"apiclaude": {
"name": "ApiClo",
"env": ["APICLO_API_KEY"],
"package": "@opencode/ai/providers/openai-compatible",
"settings": {
"baseURL": "https://apiclo.com/v1"
},
"models": {
"gpt-6-astra": {
"name": "GPT 6 Astra",
"capabilities": {
"tools": true,
"input": ["text", "image"],
"output": ["text"]
},
"limit": {
"context": 200000,
"output": 128000
}
},
"claude-fable-5-1": {
"name": "Claude Fable 5.1",
"capabilities": {
"tools": true,
"input": ["text", "image"],
"output": ["text"]
},
"limit": {
"context": 1000000,
"output": 128000
}
}
}
}
},
"model": "apiclaude/gpt-6-astra"
}
opencode
Пример относится к OpenCode v2. Для других моделей укажите их фактические capabilities; конфигурация v1 несовместима с этим примером. Windows: скачайте standalone binary по ссылке ниже. OpenCode v2
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
DeepSeek Harness
Harness поддерживает ApiClo как custom OpenAI-compatible provider. Image input включается отдельно у каждой модели.
- 1
Установите DeepSeek Harness по официальной инструкции. В Settings → Models выберите Add model provider → Custom model API.
- 2
Provider ID: apiclo; Display name: ApiClo; Base URL: https://apiclo.com/v1; API protocol: openai-completions.
- 3
Укажите переменную APICLO_API_KEY. Если Fetch available models не показывает нужный ID, добавьте модель вручную; типы входа задаются отдельно.
- 4
В Model options включите Text и Image. В профиле это поле input: [text, image] у конкретной модели.
- 5
Изменение действует со следующего запроса без перезапуска. Если в истории уже осталось проблемное изображение, создайте новую сессию.
- 6
Проверьте сначала текст, затем PNG/JPEG. Если Harness пишет model does not support images до запроса, capability всё ещё не сохранён у выбранной модели.
Для стандартного dsh web файл находится в $DSH_HOME/profiles/web/cordis.patch.yml; у другого профиля замените web на его имя. При ручном редактировании существующего файла сохраните остальные записи.
$DSH_HOME/profiles/web/cordis.patch.yml
- id: llm-pi-ai
config:
providers:
apiclo:
apiKeyEnv: APICLO_API_KEY
api: openai-completions
baseURL: https://apiclo.com/v1
models:
- id: gpt-6-astra
input: [text, image]
- id: claude-fable-5-1
input: [text, image]
# macOS / Linux
export APICLO_API_KEY="sk-hub-..."
dsh web
# Windows PowerShell
$env:APICLO_API_KEY="sk-hub-..."
dsh web
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Claude Code
Claude Code обычно ожидает Anthropic-compatible base URL без /v1.
- 1
Проверьте Node.js 18+: node --version.
- 2
Установите Claude Code: npm install -g @anthropic-ai/claude-code@latest.
- 3
Проверьте установку: claude --version.
- 4
Для ApiClo используйте ANTHROPIC_AUTH_TOKEN + ANTHROPIC_BASE_URL; ANTHROPIC_API_KEY нужен только клиентам, которые требуют x-api-key.
- 5
Задайте CLAUDE_CODE_AUTO_COMPACT_WINDOW=180000: Claude Code заранее сохранит summary длинной сессии перед 200k boundary. Это не ограничивает размер ответа.
- 6
Сначала проверьте gateway прямым запросом /v1/messages, потом запускайте claude из той же shell-сессии.
- 7
В Claude Code выполните /status и убедитесь, что показан ApiClo base URL и активный token source.
npm install -g @anthropic-ai/claude-code@latest
# macOS / Linux
export ANTHROPIC_AUTH_TOKEN="sk-hub-..."
export ANTHROPIC_BASE_URL="https://apiclo.com"
export ANTHROPIC_MODEL="claude-sonnet-5"
export CLAUDE_CODE_AUTO_COMPACT_WINDOW="180000"
claude
# Windows PowerShell
$env:ANTHROPIC_AUTH_TOKEN="sk-hub-..."
$env:ANTHROPIC_BASE_URL="https://apiclo.com"
$env:ANTHROPIC_MODEL="claude-sonnet-5"
$env:CLAUDE_CODE_AUTO_COMPACT_WINDOW="180000"
claude
~/.claude/settings.json
{
"env": {
"ANTHROPIC_BASE_URL": "https://apiclo.com",
"ANTHROPIC_AUTH_TOKEN": "sk-hub-...",
"CLAUDE_CODE_AUTO_COMPACT_WINDOW": "180000"
}
}
curl /v1/messages smoke
# macOS / Linux
curl -X POST "$ANTHROPIC_BASE_URL/v1/messages" \
-H "Authorization: Bearer $ANTHROPIC_AUTH_TOKEN" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d "{\"model\":\"$ANTHROPIC_MODEL\",\"max_tokens\":1,\"messages\":[{\"role\":\"user\",\"content\":\".\"}]}"
# Windows PowerShell
Invoke-RestMethod -Method Post -Uri "$($env:ANTHROPIC_BASE_URL)/v1/messages" `
-Headers @{ "Authorization" = "Bearer $env:ANTHROPIC_AUTH_TOKEN"; "anthropic-version" = "2023-06-01" } `
-ContentType "application/json" `
-Body (@{ model = $env:ANTHROPIC_MODEL; max_tokens = 1; messages = @(@{ role = "user"; content = "." }) } | ConvertTo-Json -Depth 4)
Если smoke отвечает JSON с msg_ — URL и ключ рабочие. Если 401 — клиент отправил ключ не тем header; используйте ANTHROPIC_API_KEY только для x-api-key сценария.
Изображения: в Claude Code прикрепляйте локальный файл штатной командой/кнопкой и выбирайте vision-capable модель. Отдельный provider-флаг обычно не нужен, но image + text smoke обязателен после смены endpoint.
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Codex
Codex CLI и IDE-расширение можно направить в ApiClo через custom provider в config.toml.
- 1
В Codex IDE-расширении откройте Codex Settings → Open config.toml; CLI использует тот же ~/.codex/config.toml.
- 2
Добавьте provider в user-level config, потому что project .codex/config.toml не должен задавать provider/auth.
- 3
Задайте переменную APICLAUDE_API_KEY со значением sk-hub ключа. Это имя выбрано в env_key ниже.
- 4
Оставьте wire_api = responses: в актуальном Codex это поддерживаемый protocol для provider.
- 5
Запустите codex в тестовой папке и проверьте Ответь только OK.
~/.codex/config.toml
model = "claude-sonnet-5"
model_provider = "apiclaude"
[model_providers.apiclaude]
name = "ApiClo"
base_url = "https://apiclo.com/v1"
env_key = "APICLAUDE_API_KEY"
wire_api = "responses"
APICLAUDE_API_KEY env
# macOS / Linux
export APICLAUDE_API_KEY="sk-hub-..."
codex
# Windows PowerShell
$env:APICLAUDE_API_KEY="sk-hub-..."
codex
Если Codex не принимает provider config, сначала обновите Codex. Не переключайте wire_api на Chat Completions: текущая документация Codex описывает responses как поддерживаемый provider protocol.
Изображения: в IDE-расширении прикрепите изображение через composer; в CLI укажите локальный путь штатным способом. Проверьте image + text запрос отдельно: настройка provider сама по себе не доказывает доставку вложения.
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
OpenClaw
OpenClaw можно подключить через models.json с двумя provider-режимами.
- 1
Установите OpenClaw по инструкции вашей платформы и проверьте openclaw --version.
- 2
Найдите файл моделей OpenClaw или создайте models.json в папке конфигурации.
- 3
Если нужен Claude Messages режим, используйте provider apiclaude-messages с baseUrl https://apiclo.com.
- 4
Если нужен OpenAI Completions режим, используйте provider apiclaude-openai с baseUrl https://apiclo.com/v1.
- 5
У каждой vision-модели добавьте input: [text, image], иначе OpenClaw передаст только текстовую media-ссылку или не вложит изображение.
- 6
Замените apiKey на sk-hub ключ и запустите отдельные text/tool/image тесты в проекте.
{
"models": {
"mode": "merge",
"providers": {
"apiclaude-messages": {
"baseUrl": "https://apiclo.com",
"apiKey": "sk-hub-...",
"auth": "token",
"api": "anthropic-messages",
"models": [
{
"id": "claude-sonnet-5",
"name": "claude-sonnet-5",
"input": ["text", "image"],
"contextWindow": 1000000,
"maxTokens": 64000
}
]
},
"apiclaude-openai": {
"baseUrl": "https://apiclo.com/v1",
"apiKey": "sk-hub-...",
"auth": "token",
"api": "openai-completions",
"models": [
{ "id": "claude-opus-4-8", "name": "claude-opus-4-8", "input": ["text", "image"] }
]
}
}
}
}
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Qwen Code
Если Qwen Code установлен как OpenAI-compatible клиент, достаточно OPENAI_* переменных.
- 1
Проверьте Node.js: node --version.
- 2
Установите Qwen Code: npm install -g @qwen-code/qwen-code@latest.
- 3
Проверьте qwen --version и qwen --help.
- 4
Для OpenAI-compatible режима задайте OPENAI_API_KEY, OPENAI_BASE_URL и OPENAI_MODEL.
- 5
Если ваша сборка Qwen Code поддерживает Anthropic env, можно использовать ANTHROPIC_AUTH_TOKEN + https://apiclo.com для Claude models.
- 6
Изображения используйте только если установленная версия Qwen Code показывает attachment/image input для custom endpoint; иначе клиент может отправить только текст.
- 7
Запустите qwen и выполните OK/read-only тест.
npm install -g @qwen-code/qwen-code@latest
export OPENAI_API_KEY="sk-hub-..."
export OPENAI_BASE_URL="https://apiclo.com/v1"
export OPENAI_MODEL="claude-sonnet-5"
qwen
$env:OPENAI_API_KEY="sk-hub-..."
$env:OPENAI_BASE_URL="https://apiclo.com/v1"
$env:OPENAI_MODEL="claude-sonnet-5"
qwen
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Aider
Aider работает через OpenAI-compatible переменные.
- 1
Установите Aider: python -m pip install -U aider-chat.
- 2
Откройте терминал в git-проекте, где можно безопасно тестировать изменения.
- 3
Задайте OPENAI_API_BASE и OPENAI_API_KEY.
- 4
Запустите aider --model openai/claude-sonnet-5.
- 5
Для изображения выполните /add image.png или /paste, затем задайте текстовый вопрос; выбранная модель должна поддерживать vision.
- 6
Сначала попросите объяснить файл, затем только после проверки разрешайте правки.
python -m pip install -U aider-chat
OPENAI_API_BASE=https://apiclo.com/v1
OPENAI_API_KEY=sk-hub-...
aider --model openai/claude-sonnet-5
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Oh My Pi (OMP)
OMP подключается через ~/.omp/agent/models.yml. Для vision capability задаётся полем input у модели.
- 1
Установите OMP: curl -fsSL https://omp.sh/install | sh; в Windows PowerShell: irm https://omp.sh/install.ps1 | iex.
- 2
Создайте ~/.omp/agent/models.yml и добавьте custom provider apiclo.
- 3
Укажите apiKey как имя переменной APICLO_API_KEY, а не сам ключ в репозитории.
- 4
Оставьте input: [text, image] у vision-моделей: OMP проверяет это поле до отправки вложения.
- 5
Запустите omp models find apiclo, затем omp и проверьте текст, tools и отдельное изображение.
~/.omp/agent/models.yml
providers:
apiclo:
baseUrl: https://apiclo.com/v1
api: openai-completions
apiKey: APICLO_API_KEY
models:
- id: gpt-6-astra
name: GPT 6 Astra
input: [text, image]
contextWindow: 200000
maxTokens: 128000
- id: claude-fable-5-1
name: Claude Fable 5.1
input: [text, image]
contextWindow: 1000000
maxTokens: 128000
export APICLO_API_KEY="sk-hub-..."
omp models find apiclo
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Pi
Pi поддерживает custom OpenAI-compatible модели через models.json; укажите image capability явно.
- 1
Установите Pi по официальной инструкции и создайте ~/.pi/agent/models.json.
- 2
Задайте APICLO_API_KEY в окружении; не сохраняйте ключ в файле проекта.
- 3
В /model выберите apiclo/gpt-6-astra или apiclo/claude-fable-5-1.
- 4
Проверьте короткий текстовый запрос, tool call и отдельное изображение с текстовым вопросом. Наличие input: image само по себе не доказывает доставку изображения.
~/.pi/agent/models.json
{
"providers": {
"apiclo": {
"baseUrl": "https://apiclo.com/v1",
"api": "openai-completions",
"apiKey": "$APICLO_API_KEY",
"models": [
{ "id": "gpt-6-astra", "input": ["text", "image"], "contextWindow": 200000 },
{ "id": "claude-fable-5-1", "input": ["text", "image"], "contextWindow": 1000000 }
]
}
}
}
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Kimi Code
Kimi Code допускает custom OpenAI-compatible provider; совместимость с ApiClo ещё проходит матрицу тестов.
- 1
Установите Kimi Code и откройте ~/.kimi-code/config.toml; сохраните существующие настройки.
- 2
Задайте APICLO_API_KEY в окружении и добавьте provider типа openai с base_url /v1.
- 3
Зарегистрируйте нужную модель с image_in и tool_use, затем выберите её в клиенте.
- 4
Проверьте текст, tools, reasoning и изображение отдельно. До прохождения тестов не считайте эту интеграцию проверенной для автономных задач.
~/.kimi-code/config.toml
[providers.apiclo]
type = "openai"
base_url = "https://apiclo.com/v1"
api_key_env = "APICLO_API_KEY"
[models."apiclo/gpt-6-astra"]
provider = "apiclo"
model = "gpt-6-astra"
max_context_size = 200000
capabilities = ["image_in", "tool_use"]
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Orca
Orca управляет несколькими CLI-агентами и изолированными git worktree. Он не заменяет provider-конфиг дочернего агента.
- 1
Сначала настройте один рабочий исполнитель с ApiClo: Codex, Claude Code, OpenCode или OMP, включая отдельный vision-тест.
- 2
Установите Orca Desktop/ADE по официальному release для вашей ОС и откройте нужный git-репозиторий.
- 3
Добавьте уже настроенный CLI как agent runtime. ApiClo key остаётся в безопасном хранилище или env самого CLI, а не в Orca project files.
- 4
Для параллельной работы включайте отдельный worktree на каждого агента и ограничивайте число одновременных workers.
- 5
Изображения передавайте в конкретную сессию дочернего CLI. Поддержка определяется его model capability: OpenCode modalities, Harness/OMP input или Crush supports-images.
Orca — оркестратор, а не OpenAI-compatible provider. Не вставляйте Base URL и API key в Orca вместо настройки Codex/OpenCode/OMP.
Crush
Crush поддерживает OpenAI-compatible providers и отдельный supports-images флаг для каждой custom-модели.
- 1
Установите актуальный Crush и откройте глобальный crushrc: ~/.config/crush/crushrc или %USERPROFILE%\.config\crush\crushrc.
- 2
Добавьте provider apiclo типа openai-compat и отключите автодобавление неизвестных моделей.
- 3
Зарегистрируйте каждую модель через model add и обязательно задайте --supports-images true только для vision-моделей.
- 4
Выберите большую модель командой model large и запустите Crush из тестового проекта.
- 5
На Windows к изображению добавляйте текстовый вопрос: некоторые версии Crush отклоняют image-only prompt.
~/.config/crush/crushrc
provider add apiclo \
--name "ApiClo" \
--type openai-compat \
--base-url "https://apiclo.com/v1" \
--api-key "$APICLO_API_KEY" \
--discover-models false
model add apiclo/gpt-6-astra \
--name "GPT 6 Astra" \
--context-window 200000 \
--default-max-tokens 128000 \
--can-reason true \
--supports-images true
model large apiclo/gpt-6-astra
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Goose
Goose умеет custom OpenAI-compatible providers в Desktop и CLI. Для картинок проверяйте capability выбранной версии отдельным тестом.
- 1
Откройте Settings → Models → Configure providers → Add Custom Provider.
- 2
Provider Type: OpenAI Compatible; Display Name: ApiClo; API URL: https://apiclo.com/v1/chat/completions.
- 3
Включите Authentication, сохраните sk-hub key и добавьте модели gpt-6-astra и claude-fable-5-1.
- 4
Включите Streaming Support и проверьте короткий текстовый запрос.
- 5
Текущий custom-provider экран Goose не задаёт универсальный per-model vision-флаг. Если кнопка вложения скрыта или файл удаляется до запроса, используйте OpenCode, Harness, OMP или Crush, где capability задаётся явно.
API URL: https://apiclo.com/v1/chat/completions
Models: gpt-6-astra, claude-fable-5-1
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Gemini CLI
Gemini CLI сейчас не является хорошим прямым вариантом для ApiClo, если сборка не дает задать custom OpenAI/Anthropic endpoint.
- 1
Сначала проверьте, есть ли в вашей версии Gemini CLI настройка custom base URL.
- 2
Если custom endpoint недоступен, не пытайтесь подменять системные Google переменные: используйте Cline, Roo, Kilo или Qwen Code.
- 3
Если custom OpenAI-compatible endpoint есть, используйте Base URL https://apiclo.com/v1, API key sk-hub и model claude-sonnet-5.
- 4
Изображения проверяйте отдельным тестом: custom endpoint должен получать image part, а не только локальный путь. Если версия Gemini CLI этого не умеет, выберите OpenCode, Harness, OMP или Crush.
- 5
После настройки выполните только read-only тест. Если клиент продолжает обращаться к Google endpoint, переключитесь на поддерживаемый CLI.
Recommended alternative: Qwen Code, Cline, Roo Code, Kilo Code
Агенты и локальный router
Для управляемых агентов лучше использовать интерфейс ApiClo, а не free-модели во внешнем API.
Hermes Agent
Встроенный Hermes живет внутри ApiClo: баланс, модель, память и история управляются из раздела Agents.
- 1
Откройте Agents и выберите Hermes.
- 2
Выберите модель из платного списка: claude-sonnet-5, claude-opus-4-8, claude-sonnet-4-6.
- 3
Для веб-страниц включайте web context в чате; URL будет прочитан через ApiClo reader/browser fallback.
- 4
Для изображения используйте attachment в composer и vision-capable модель; после загрузки задайте текстовый вопрос, чтобы отличить реальное image input от имени файла.
- 5
Чтобы Hermes работал с вашим компьютером, скачайте Desktop Bridge, создайте pairing code и выдайте только нужные разрешения на файлы или папки.
- 6
Для длинных задач не меняйте модель в середине цепочки без причины: это помогает кэшу и контексту.
ApiClo Desktop / Local Router
Локальный router нужен, когда клиент умеет говорить только с localhost или когда вы хотите централизовать ключ на машине.
- 1
Скачайте ApiClo Desktop Bridge и запустите его на той же машине, где работает IDE/CLI.
- 2
Вставьте upstream sk-hub ключ в Desktop Bridge.
- 3
Нажмите Fetch models и убедитесь, что список моделей загрузился.
- 4
Нажмите Start router.
- 5
В IDE/CLI укажите Local Base URL http://127.0.0.1:18441/v1 и любой непустой client API key.
- 6
Для изображений включите capability в самой IDE/CLI: Desktop Router прозрачно передаёт multipart/base64 image content, но не создаёт кнопку вложения и не объявляет vision за клиента.
- 7
Проверьте Ответь только OK; если не отвечает, проверьте, что локальный router запущен и порт 18441 свободен.
Download Windows: https://apiclo.com/downloads/ApiCloDesktopBridge.exe
Python app: https://apiclo.com/downloads/desktop-bridge-app.pyw
Python script: https://apiclo.com/downloads/desktop-bridge.py
Local Base URL: http://127.0.0.1:18441/v1
Client API Key: any non-empty value
Upstream key in Desktop Bridge: sk-hub-...
Сначала нажмите Fetch models, затем Start router. В IDE указывайте local Base URL, а не публичный.
Все модели 21 Model ID
Скопируйте точный Model ID.
Claude
GPT
Raw API и SDK
ApiClo принимает OpenAI-compatible, Anthropic-compatible и Responses-style запросы через публичный /v1.
OpenAI-compatible
Главный route для IDE, SDK и большинства self-hosted интерфейсов.
curl https://apiclo.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Hi"}],
"max_tokens": 512,
"stream": true
}'
Anthropic-compatible
Используйте для клиентов, которые ожидают Claude Messages API.
curl https://apiclo.com/v1/messages \
-H "x-api-key: YOUR_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5",
"max_tokens": 512,
"messages": [{"role": "user", "content": "Hi"}]
}'
Responses API
Используйте для клиентов, где нужен Responses wire API.
curl https://apiclo.com/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5",
"input": "Write a short checklist for release QA."
}'
Python SDK
Подходит для скриптов, backend jobs и тестов.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://apiclo.com/v1",
)
response = client.chat.completions.create(
model="claude-sonnet-5",
messages=[{"role": "user", "content": "Hi"}],
max_tokens=512,
)
print(response.choices[0].message.content)
JavaScript / TypeScript
Подходит для frontend-backed API routes и Node.js сервисов.
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.APICLAUDE_API_KEY,
baseURL: "https://apiclo.com/v1",
});
const response = await client.chat.completions.create({
model: "claude-sonnet-5",
messages: [{ role: "user", content: "Hi" }],
max_tokens: 512,
});
console.log(response.choices[0].message.content);
Проверка перед реальной задачей
Сначала докажите, что клиент правильно подключен. Это занимает минуту и экономит деньги на ошибочных IDE-запросах.
Откройте список моделей с тем же ключом, который вставлен в клиент. Если список не открывается, сначала чините ключ или Base URL.
https://apiclo.com/v1/models
Отправьте короткий non-stream запрос: Ответь только OK. Это проверяет ключ, модель и базовый chat route.
Reply only OK
Если клиент поддерживает streaming, повторите тот же короткий тест со stream. Это ловит проблемы с SSE до большой задачи.
stream: true
Для IDE-агента попросите прочитать текущую папку и сказать, есть ли README.md, без изменений файлов.
Посмотри текущую папку и скажи, есть ли README.md. Ничего не меняй.
Если клиент использует tools, проверьте маленькую read-only tool-задачу до heavy coding. Успех должен содержать нормальный ответ, а не пустой tool result.
Длинный контекст проверяйте только после базовых тестов. Начинайте с чтения конкретных файлов, а не всего репозитория.
Ключи, расходы и логи
Один баланс может обслуживать много клиентов, но для отладки и контроля расходов лучше разделять ключи по проектам.
Создавайте отдельный API key для IDE, CLI, backend или тестового окружения. Так в Usage и Logs видно, кто именно тратит токены.
Баланс и пополнение находятся в Dashboard. Подробные запросы, токены, стоимость, статус и ошибки смотрите в Logs.
Coding extensions часто отправляют tool schema, терминал, diff, историю, карту файлов и большой системный промпт. Это нормальный режим агентской работы. Чтобы снизить расход, просите читать конкретные файлы, исключайте node_modules/dist/logs/dumps и не повышайте maxTokens без причины.
Если вы остановили stream после того, как модель уже начала отвечать, часть запроса могла быть посчитана. Не запускайте слепой retry для file-changing tool calls; сначала проверьте Logs и состояние файлов.
После действительной регистрации по реферальной ссылке приглашённый пользователь получает одно бесплатное вращение. Пригласивший не получает вращение за регистрацию: его вознаграждение — 10% от первого уровня и 3% от второго уровня по условиям реферальной программы. Квестовые вращения используют отдельный призовой пул. Каждое вращение выигрывает невыводимый сервисный кредит ApiClo; актуальные шансы всегда опубликованы в полных правилах.
Модели
Для IDE и API используйте платные model id. Free aliases оставьте веб-чату.
GPT 6.1 Sol · API / IDE / Hermes / Web
Тариф на вход, выход и prompt cache — как у GPT 6 Sol. Актуальные цены — в таблице ниже.
- API / IDE — Используйте свой API-ключ и model: gpt-6.1-sol. Отправляйте запросы на /v1/chat/completions или /v1/responses по примерам ниже.
- Web Chat — Откройте выбор модели, выберите GPT 6.1 Sol и отправьте сообщение. В селекторе effort по умолчанию стоит high.
- Hermes — Выберите GPT 6.1 Sol в настройках модели агента или селекторе чата и запустите задачу. Инструменты работают через тот же API.
Выбирайте gpt-6.1-sol явно. По умолчанию ApiClo использует high и сохраняет переданный low, medium, high, xhigh или max. none и minimal не поддерживаются. Доступны текст и изображения на входе. GPT 6 Sol остаётся отдельной моделью.
Для инструментов IDE и агентов используйте Chat Completions или Responses ApiClo. ApiClo переводит Chat tools в Responses провайдера. Возвращайте результат с исходным tool_call_id или call_id и сохраняйте порядок диалога. Лимит ответа контролирует провайдер подписки.
{"model":"gpt-6.1-sol","reasoning_effort":"high","messages":[{"role":"user","content":"Hello"}],"stream":true}
{"model":"gpt-6.1-sol","reasoning":{"effort":"high"},"input":"Hello","stream":true}
Claude Sonnet 5.5 · API / Hermes / Web
Используйте claude-sonnet-5-5. Effort: low, medium, high (по умолчанию), xhigh или max. В Messages доступны adaptive и between_tools с low/medium/high. Ручной бюджет thinking, disabled, принудительный вызов инструмента и префилл ответа не поддерживаются. В цикле инструментов сохраняйте подписанные thinking-блоки и предшествующий контекст без изменений; не переносите эти блоки в другую модель. Используйте параметры сэмплирования по умолчанию. Для Claude Code нужна версия 2.1.284 или новее.
claude-sonnet-5-5
| Model ID | Лучше для | Контекст провайдера | Вывод провайдера | Вывод ApiClo | Tools | Vision | Заметки |
|---|---|---|---|---|---|---|---|
claude-opus-5-5 |
medium по умолчанию; цена как у Opus 5 | 1M | 128k | 128k max · 64k default | yes | yes | Используйте точный Model ID |
gpt-6-sol |
high по умолчанию; цена как у Sol 5.6 | 1.05M | 128k | 128k max · 64k default | yes | зависит от клиента | Используйте точный Model ID |
gpt-6-luna |
в 10 раз дешевле Sol | 1.05M | 128k | 128k max · 64k default | yes | зависит от клиента | Используйте точный Model ID |
gpt-6-astra |
high по умолчанию; вход ApiClo до 200k | 1.05M | 128k | Responses: лимит задаёт провайдер | yes | зависит от клиента | Используйте точный Model ID |
claude-fable-5-1 |
новая версия Fable | 1M | 128k | 128k max · 64k default | yes | yes | Используйте точный Model ID |
gpt-5-6-sol |
флагманский preview route | 1.05M | 128k | 128k max · 64k default | yes | зависит от клиента | Используйте точный Model ID |
claude-opus-5 |
новый флагманский route | 1M | 128k | 128k max · 64k default | yes | yes | Используйте точный Model ID |
claude-sonnet-5-5 |
High по умолчанию; адаптивные рассуждения | 1M | 128k | 128k max · 64k default | yes | yes | Используйте точный Model ID |
claude-sonnet-5 |
сбалансированный платный route | 1M | 128k | 128k max · 64k default | yes | yes | Используйте точный Model ID |
gpt-5-6-terra |
сбалансированный preview route | 1.05M | 128k | 128k max · 64k default | yes | зависит от клиента | Используйте точный Model ID |
gpt-5-6-luna |
быстрый preview route | 1.05M | 128k | 128k max · 64k default | yes | зависит от клиента | Используйте точный Model ID |
claude-fable-5 |
предыдущая версия Fable | 1M | 128k | 128k max · 64k default | yes | yes | Используйте точный Model ID |
claude-opus-4-8 |
сильный coding и reasoning | 1M | 128k | 128k max · 64k default | yes | yes | Используйте точный Model ID |
claude-opus-4-7 |
сильный coding и reasoning | 1M | 128k | 128k max · 64k default | yes | yes | Используйте точный Model ID |
claude-sonnet-4-6 |
стабильный default | 1M | 128k | 128k max · 64k default | yes | yes | Используйте точный Model ID |
gpt-5-5 |
GPT paid route | 1.05M | 128k | 128k max · 64k default | yes | зависит от клиента | Используйте точный Model ID |
claude-haiku-4-5 |
быстро и дешевле | 200k | 64k | 64k | yes | yes | Используйте точный Model ID |
claude-opus-4-6 |
legacy strong route | 1M | 128k | 128k max · 64k default | yes | yes | Используйте точный Model ID |
claude-sonnet-4-5 |
стабильный fallback | 200k | 64k | 64k | yes | yes | Используйте точный Model ID |
claude-opus-4-5 |
legacy strong route | 200k | 64k | 64k | yes | yes | Используйте точный Model ID |
gpt-6.1-sol |
High по умолчанию; инструменты через Responses | 1.05M | 128k | Лимит ответа задаёт провайдер | yes | зависит от клиента | Используйте точный Model ID |
Контекст и provider output — официальные пределы модели. ApiClo больше не применяет старый лимит 128k/184k входных токенов: запрос ограничивается окном выбранной модели и общим безопасным пределом размера запроса. Public API использует безопасный default 64k output-токенов; клиент может явно запросить до 128k у моделей с таким provider limit. При fallback ApiClo автоматически снижает лимит до максимума фактической целевой модели.
Тарифы моделей и prompt cache
Все значения указаны в долларах за 1 миллион токенов. Кэш оплачивается только для токенов, которые провайдер явно указал как запись или чтение кэша.
Чтобы сравнивать цену API с учётом prompt cache, используйте одинаковый состав токенов для всех моделей. Пример ниже: на 1 млн токенов приходится 400 тыс. обычного входа, 400 тыс. чтения кэша и 200 тыс. выхода. Цена без кэша для сравнения — 800 тыс. обычного входа и 200 тыс. выхода. Это расчётный сценарий, а не средняя цена клиентов или рейтинг API-провайдеров. Запись и обновление кэша оплачиваются отдельно; фактическая цена зависит от доли попаданий в кэш и использования модели.
Формула за 1 млн токенов: 0,4 × цена входа + 0,4 × цена чтения кэша + 0,2 × цена выхода.
| Модель | Обычный вход | Чтение кэша | Запись кэша | Выход | Пример за 1 млн токенов: с кэшем / без кэша |
|---|---|---|---|---|---|
Claude Opus 5.5claude-opus-5-5 |
$0.40 | $0.04 · 0.10× |
$0.50 · 1.25× · 5 min $0.80 · 2.00× · 1 h |
$0.40 | $0.256 против $0.400 |
GPT 6 Solgpt-6-sol |
$0.40 | $0.04 · 0.10× | $0.50 · 1.25× | $0.40 | $0.256 против $0.400 |
GPT 6 Lunagpt-6-luna |
$0.04 | $0.004 · 0.10× | $0.05 · 1.25× | $0.04 | $0.026 против $0.040 |
GPT 6 Astragpt-6-astra |
$0.60 | $0.12 · 0.20× | $0.75 · 1.25× | $0.60 | $0.408 против $0.600 |
Claude Fable 5.1claude-fable-5-1 |
$1.20 | $0.16 · 0.13× |
$1.50 · 1.25× · 5 min $2.40 · 2.00× · 1 h |
$1.20 | $0.784 против $1.200 |
GPT 5.6 Solgpt-5-6-sol |
$0.40 | $0.04 · 0.10× | $0.50 · 1.25× | $0.40 | $0.256 против $0.400 |
Claude Opus 5claude-opus-5 |
$0.40 | $0.04 · 0.10× |
$0.50 · 1.25× · 5 min $0.80 · 2.00× · 1 h |
$0.40 | $0.256 против $0.400 |
Claude Sonnet 5.5claude-sonnet-5-5 |
$0.35 | $0.035 · 0.10× |
$0.4375 · 1.25× · 5 min $0.70 · 2.00× · 1 h |
$0.35 | $0.224 против $0.350 |
Claude Sonnet 5claude-sonnet-5 |
$0.38 | $0.038 · 0.10× |
$0.475 · 1.25× · 5 min $0.76 · 2.00× · 1 h |
$0.38 | $0.243 против $0.380 |
GPT 5.6 Terragpt-5-6-terra |
$0.30 | $0.03 · 0.10× | $0.375 · 1.25× | $0.30 | $0.192 против $0.300 |
GPT 5.6 Lunagpt-5-6-luna |
$0.19 | $0.019 · 0.10× | $0.238 · 1.25× | $0.19 | $0.122 против $0.190 |
Claude Fable 5claude-fable-5 |
$0.80 | $0.08 · 0.10× |
$1.00 · 1.25× · 5 min $1.60 · 2.00× · 1 h |
$0.80 | $0.512 против $0.800 |
Claude Opus 4.8claude-opus-4-8 |
$0.40 | $0.04 · 0.10× |
$0.50 · 1.25× · 5 min $0.80 · 2.00× · 1 h |
$0.40 | $0.256 против $0.400 |
Claude Opus 4.7claude-opus-4-7 |
$0.29 | $0.029 · 0.10× |
$0.363 · 1.25× · 5 min $0.58 · 2.00× · 1 h |
$0.29 | $0.186 против $0.290 |
Claude Sonnet 4.6claude-sonnet-4-6 |
$0.32 | $0.032 · 0.10× |
$0.40 · 1.25× · 5 min $0.64 · 2.00× · 1 h |
$0.32 | $0.205 против $0.320 |
ChatGPT 5.5gpt-5-5 |
$0.40 | $0.04 · 0.10× | — | $0.40 | $0.256 против $0.400 |
Claude Haiku 4.5claude-haiku-4-5 |
$0.32 | $0.032 · 0.10× |
$0.40 · 1.25× · 5 min $0.64 · 2.00× · 1 h |
$0.32 | $0.205 против $0.320 |
Claude Opus 4.6claude-opus-4-6 |
$0.29 | $0.029 · 0.10× |
$0.363 · 1.25× · 5 min $0.58 · 2.00× · 1 h |
$0.29 | $0.186 против $0.290 |
Claude Sonnet 4.5claude-sonnet-4-5 |
$0.32 | $0.032 · 0.10× |
$0.40 · 1.25× · 5 min $0.64 · 2.00× · 1 h |
$0.32 | $0.205 против $0.320 |
Claude Opus 4.5claude-opus-4-5 |
$0.40 | $0.04 · 0.10× |
$0.50 · 1.25× · 5 min $0.80 · 2.00× · 1 h |
$0.40 | $0.256 против $0.400 |
GPT 6.1 Solgpt-6.1-sol |
$0.40 | $0.04 · 0.10× | $0.50 · 1.25× | $0.40 | $0.256 против $0.400 |
Для Claude Fable 5.1 чтение кэша стоит 2/15 цены входа (около 13,33%), для GPT 6 Astra — 20%, для остальных моделей в текущем каталоге — 10%. Запись кэша на 5 минут стоит 125%, а для Claude запись на 1 час — 200%. Если провайдер не сообщил cache-read/cache-write токены, кэш по этой категории не начисляется. При автоматическом fallback сохраняется тариф выбранной пользователем модели.
У Claude обычный вход, чтение кэша и запись кэша — отдельные взаимоисключающие категории provider usage. Поэтому в конкретном запросе обычный вход может быть равен нулю, а весь промпт отображаться как cache-read или cache-write; это не означает, что входные токены потерялись. Coding-клиент может заново создавать кэш, когда меняет кэшируемый префикс или сам передаёт новые cache_control блоки.
Точный расчёт конкретного запроса, количество cache-read/cache-write токенов и применённые ставки доступны в Logs → Почему списалось?
Jev · решения по API (beta)
Jev оценивает state и возвращает структурированные ответы noul, choice или score. Это не чат-модель: /chat/completions, /responses, /messages, streaming, tools и генерация текста не поддерживаются.
Model ID: jev-latest · POST: https://apiclo.com/v1/decisions · совместимый путь https://apiclo.com/v1/systemone · GET: https://apiclo.com/v1/models?type=decision
Тариф ApiClo: $0.0525 за 1 млн входных токенов; выходные токены считаются в usage, но стоят $0. Venice beta. Предел: state плюс самый длинный вопрос до 32K токенов; state плюс все вопросы до 64K токенов. Оценивайте качество решений на своих данных.
Передайте Authorization: Bearer с ключом ApiClo, Content-Type: application/json и уникальный Idempotency-Key (8–128 печатных ASCII-символов) для каждого логического запроса. Повтор с тем же ключом и телом вернёт сохранённый ответ; после таймаута запрос автоматически не отправляется снова.
curl -X POST https://apiclo.com/v1/decisions \
-H 'Authorization: Bearer YOUR_APICLO_KEY' \
-H 'Content-Type: application/json' \
-H 'Idempotency-Key: ticket-123-v1' \
-d '{"model":"jev-latest","state":"Payout failed","questions":{"urgent":{"type":"noul","instructions":"Is this urgent?"}}}'
Пример choice: {"model":"jev-latest","state":{"ticket":"Duplicate charge"},"questions":{"team":{"type":"choice","instructions":"Which team?","criteria":{"billing":"Payments","technical":"Bugs"}}}}
Пример score: {"model":"jev-latest","state":"Service unavailable","questions":{"severity":{"type":"score","instructions":"How severe?","criteria":["Low","Medium","High"]}}}
Python SDK TypeSafe использует TYPESAFE_BASE_URL=https://apiclo.com и TYPESAFE_API_KEY=ключ ApiClo. Передайте extra_headers с Idempotency-Key и отключите автоматические повторы через RetryPolicy(max_retries=0); SDK вызывает /v1/systemone.
from typesafe_sdk import Noul, RetryPolicy, TypeSafeClient
with TypeSafeClient(retry=RetryPolicy(max_retries=0)) as client:
result = client.system_one(
"Payout failed three times",
{"urgent": Noul(instructions="Is this urgent?")},
extra_headers={"Idempotency-Key": "ticket-123-v1"},
)
Ошибки: invalid_decision_request — исправьте JSON; balance_too_low — пополните ApiClo; provider_credit_exhausted — временная проблема провайдера, баланс ApiClo не списан; provider_rate_limited — ограничение Venice; provider_completion_unknown — результат неясен, сохраните Idempotency-Key; provider_response_unverified — неверный ответ или usage, списания нет.
claude-opus-5-5
medium по умолчанию; цена как у Opus 5 · 1M context · 128k provider output · 128k max · 64k default ApiClo output
gpt-6-sol
high по умолчанию; цена как у Sol 5.6 · 1.05M context · 128k provider output · 128k max · 64k default ApiClo output
gpt-6-luna
в 10 раз дешевле Sol · 1.05M context · 128k provider output · 128k max · 64k default ApiClo output
gpt-6-astra
high по умолчанию; вход ApiClo до 200k · 1.05M context · 128k provider output · Responses: лимит задаёт провайдер ApiClo output
claude-fable-5-1
новая версия Fable · 1M context · 128k provider output · 128k max · 64k default ApiClo output
gpt-5-6-sol
флагманский preview route · 1.05M context · 128k provider output · 128k max · 64k default ApiClo output
claude-opus-5
новый флагманский route · 1M context · 128k provider output · 128k max · 64k default ApiClo output
claude-sonnet-5-5
High по умолчанию; адаптивные рассуждения · 1M context · 128k provider output · 128k max · 64k default ApiClo output
claude-sonnet-5
сбалансированный платный route · 1M context · 128k provider output · 128k max · 64k default ApiClo output
gpt-5-6-terra
сбалансированный preview route · 1.05M context · 128k provider output · 128k max · 64k default ApiClo output
gpt-5-6-luna
быстрый preview route · 1.05M context · 128k provider output · 128k max · 64k default ApiClo output
claude-fable-5
предыдущая версия Fable · 1M context · 128k provider output · 128k max · 64k default ApiClo output
claude-opus-4-8
сильный coding и reasoning · 1M context · 128k provider output · 128k max · 64k default ApiClo output
claude-opus-4-7
сильный coding и reasoning · 1M context · 128k provider output · 128k max · 64k default ApiClo output
claude-sonnet-4-6
стабильный default · 1M context · 128k provider output · 128k max · 64k default ApiClo output
gpt-5-5
GPT paid route · 1.05M context · 128k provider output · 128k max · 64k default ApiClo output
claude-haiku-4-5
быстро и дешевле · 200k context · 64k provider output · 64k ApiClo output
claude-opus-4-6
legacy strong route · 1M context · 128k provider output · 128k max · 64k default ApiClo output
claude-sonnet-4-5
стабильный fallback · 200k context · 64k provider output · 64k ApiClo output
claude-opus-4-5
legacy strong route · 200k context · 64k provider output · 64k ApiClo output
gpt-6.1-sol
High по умолчанию; инструменты через Responses · 1.05M context · 128k provider output · Лимит ответа задаёт провайдер ApiClo output
GPT 6 Astra /v1/responses: параметры max_output_tokens, max_completion_tokens и max_tokens не поддерживаются текущим маршрутом и не передаются провайдеру. Ответ содержит X-ApiClo-Ignored-Parameters с именами таких полей. Они не гарантируют верхнюю границу длины или стоимости ответа. JSON и SSE возвращают полный ответ; история, tools и usage/cache не обрезаются. Списание считается по фактическому usage, поэтому он может превышать запрошенный лимит. Для бюджета используйте настройки баланса и доступа ключа, а не эти поля.
Поля metadata и user этого маршрута сохраняются локально для истории и биллинга, но не отправляются провайдеру. Переданные клиентом поля также перечисляются в X-ApiClo-Ignored-Parameters. Содержимое сообщений и tools не меняется. Клиентский ключ кэша используется для изоляции сессии и преобразуется в подписанный ключ маршрута, как для GPT-5.6.
Если клиент показывает Model not found, сначала откройте /models с вашим ключом и проверьте точный id.
https://apiclo.com/v1/models
Диагностика
Типовые ошибки почти всегда сводятся к ключу, base URL, model id или несовпадению протокола.
Проверьте, что вставлен полный sk-hub ключ без пробелов. Если ключ был показан один раз и потерян, создайте новый.
Сверьте model id с /models. Не используйте display name вместо id.
Чаще всего это неверный model id для конкретного клиента. В Continue, SDK и raw API используйте claude-sonnet-5, а не apiclaude/claude-sonnet-5.
Проверьте, не добавил ли клиент второй /v1. Для OpenAI-compatible нужен /v1, для Anthropic Messages/custom base обычно root без /v1.
Исключите node_modules, dist, logs, бинарные файлы и длинные dumps. Для длинных задач делайте handoff summary.
Повторите запрос с backoff. Если это IDE, сохраните тот же ключ и model id, чтобы не ломать session affinity.
Некоторые IDE режут vision в compatible mode. Проверьте обычный текстовый запрос, затем тестируйте images отдельно.