Свои серверы моделей
Вкладка «Модели» в настройках подключает чужой сервер, говорящий по протоколу Anthropic: llama-server, llama-swap, LM Studio — всё, что отдаёт /v1/messages.
Список серверов серверный: добавили с ноутбука — телефон видит сразу.
Что задаётся
Адрес и ключ, вкл/выкл, обновление списка моделей и проверка подключения.
Модель провайдера видна в общем выборе отдельной группой под именем сервера, ссылкой вида llamacpp/gpt-oss-20b. Незагруженная подписана: первый ответ на ней придёт после подкачки весов.
Отдельного переключателя провайдера нет — выбор модели и есть выбор сервера.
Две особенности, которые нельзя обойти
Смена модели на провайдера поднимает сессию заново. Своего API «сменить провайдера» у Claude Code нет: подключение — это окружение дочернего процесса CLI, а оно задаётся при старте.
Уровней усилий у таких моделей не бывает. effort — свойство моделей Anthropic, у чужого сервера его просто нет.
Проверка подключения
Идёт по шагам, и у каждого неудачного даёт подсказку:
- адрес отвечает;
- список моделей;
- протокол Anthropic —
404значит OpenAI-совместимый сервер; - схемы инструментов — llama.cpp спотыкается на тяжёлых, такой инструмент просто выключается для сессии;
- потоковый ответ.
На незагруженной модели проверка занимает до минуты, и это нормально.