Перейти к содержимому

Как выбрать модель

Первый пункт списка — «Авто»: модель подбирает сервер, по признакам самого запроса, без отдельной модели-классификатора (она стоила бы лишней секунды ожидания и лишних токенов на каждом сообщении). Правил четыре. Приложили фото — берётся модель со зрением. В сообщении просьба про код — кодинг-модель. Приложен файл, речь о документе (договор, заявление, акт, счёт) или переписка уже большая — модель с длинным контекстом. Короткий бытовой вопрос — самая дешёвая подходящая: на «какая погода» разницы в качестве не видно, а платите вы. Во всех остальных случаях берётся самая сильная модель, которая укладывается в потолок цены.

Дорогие флагманы «Авто» не выбирает никогда — есть жёсткий потолок цены за миллион входных токенов; такую модель вы включаете руками и осознанно. Ещё «Авто» проверяет, что переписка поместится в окно выбранной модели с запасом на продолжение разговора: иначе беседу пришлось бы сжимать, а ответ строился бы по пересказу вместо исходного текста. Гостю без входа «Авто» отдаёт только модели нашего контура: премиум списывает деньги с баланса, которого у гостя нет. Какая модель ответила на самом деле — написано под ответом, в строке со статистикой.

Над списком — фильтры: «Недорогие», «В контуре», «Документы», «Код», «Зрение», «Рассуждения» и год выпуска. Они складываются друг с другом и с поиском. Как только включён поиск или хотя бы один фильтр, уровни пропадают и остаётся плоский список, отсортированный по стоимости типичного запроса — от дешёвых. Считается не одна цена, а обе: входных токенов в реальных запросах примерно в двадцать раз больше выходных, поэтому цена запроса весит соответственно больше цены ответа. Устаревшие версии в таком списке уходят вниз: они дешёвые и иначе занимали бы весь верх. Кнопка «Значки» разворачивает расшифровку иконок.

Под полем ввода, слева — кнопка с названием текущей модели. На телефоне список открывается шторкой снизу: всплывающее окно закрывала бы клавиатура. Модель запоминается ЗА БЕСЕДОЙ: вернувшись в старый разговор, вы получите ту же модель, которой отвечали там, а не последнюю выбранную где-то ещё.

В каталоге больше трёхсот моделей у полусотни провайдеров, поэтому список разложен по уровням. Первый — ассистенты и «Недавние» (последние четыре модели, которыми вы пользовались). Второй — провайдеры: свои модели ArtCloud идут первыми, дальше по числу моделей; провайдеры с одной-двумя моделями собраны в «Другие». Третий уровень появляется только у крупных провайдеров — это семейства вроде «GPT 5.6», «Claude Opus», «Qwen3 VL». Поиск работает поверх уровней: помните имя модели — просто наберите его.

Под названием модели — размер контекста и цена: «1M контекст · 1,20/4,80 BYN». Контекст — сколько текста модель удерживает в одном разговоре (вопрос, история и приложенные документы вместе). Цена — за миллион входных и выходных токенов, в белорусских рублях. Значок слева — монограмма провайдера в его цвете, как в каталоге на zubriq.by/models.

Метка «В контуре» рядом с названием означает, что модель работает на наших серверах в Беларуси и данные не покидают периметр. Всё остальное — облака вендоров: запрос уходит к ним, и это нормально для большинства задач, но важно, если вы работаете с персональными данными или чувствительными договорами. По названию это неочевидно, поэтому и появилась метка: приставка в идентификаторе модели ничего не говорит о том, где она считается. Фильтр «В контуре» оставляет в списке только наши модели.

Датированные снимки моделей (вроде gpt-4o-2024-05-13), версии с объявленной вендором датой выключения и просто старые поколения не показываются сразу — они под кнопкой «Показать устаревшие» с честным счётчиком. Через поиск они находятся всегда: если вам нужен конкретный снимок, наберите его имя.

Ассистент — это профиль: он решает, КАК отвечать (юрист ищет по кодексам, банковский — по продуктам банков) и отвечает по подписке, не тратя баланс. Модель — ЧЕМ отвечать. Инструменты (документы, поиск, ЕГР, курс НБРБ) доступны и там, и там: выбор модели ничего не отключает.