VibeLab

Модели/Модели и провайдеры

У нас модель приходит внутри работника.

Модель отвечает на вопрос и тут же его забывает. Она не заведёт сделку в Bitrix24, не вспомнит вчерашний разговор и не знает, какую скидку у вас можно давать, а какую нельзя. У нас она приходит внутри роли — с доступами, памятью и регламентом.

Что стоит за работой сотрудника сегодня.

Текст

Три уровня под задачу

Короткая реплика клиенту идёт на быструю модель, разбор договора — на сильную. Уровень задаёт роль, а не длина вопроса.

Картинки

Gemini 3.1 Flash Image

Она же «нанобанана». Сотрудник рисует обложку к своему же посту и кладёт файл в документы компании.

Речь

SaluteSpeech и Yandex SpeechKit

Голосовое от клиента и запись разговора становятся текстом, с которым сотрудник уже работает.

Чего модель не делает сама

Половина работы лежит не в модели, а вокруг неё.

Не помнит вчера

Каждый разговор начинается с чистого листа. Работник помнит, о чём вы договорились в прошлый вторник, и не переспрашивает.

Не заходит в ваши программы

Написать письмо текстом она может. Отправить его, завести сделку и поставить встречу — это инструменты, а не модель.

Не знает ваших правил

Ей неоткуда узнать, кому вы даёте рассрочку. Работнику это написано в регламенте, и он от него не отступает.

Не умеет останавливаться

Модель ответит на что угодно. Работник доводит до человека то, что решать не вправе, и ждёт.

Как выбирается модель под шаг

Выбирает не человек в диалоге и не сама модель. Уровень проставлен у каждого шага ещё при сборке роли.

  1. 1

    У шага есть уровень

    Быстрый, обычный или тяжёлый. «Поздороваться» и «сверить договор с приложением» — разная работа и разная цена.

  2. 2

    Роутер берёт модель этого уровня

    Одно место в платформе решает, какая модель закрывает какой уровень. Не настройка в каждой роли по отдельности.

  3. 3

    Не ответила — пробуем ещё

    Обрыв или таймаут не роняет работу: запрос уходит повторно, а если подключено несколько провайдеров — к следующему. Придуманного ответа вместо настоящего не будет.

  4. 4

    Расход считается по факту

    В счёт попадает то, что реально израсходовано: какая модель, сколько токенов, сколько это стоило.

Можно работать на своих ключах

Если у вас уже есть договор с провайдером, сотрудник может ходить в вашу модель, а не в нашу. Расход тогда идёт по вашему договору, а не через нас.

GigaChat по ключам Сбера

В карточке подключения вводите client_id и секрет, выбираете scope и то, какая модель закрывает какой уровень: Lite на быстрый, Pro на обычный.

Свой OpenAI-совместимый адрес

Собственный сервер, vLLM, Ollama или сторонний хостинг. Нужны адрес и ключ — больше ничего.

Проверка сразу, а не в бою

После подключения жмёте «проверить»: платформа шлёт короткий запрос и показывает, ответила модель или нет.

Раздел «Языковые модели» в консоли.

Подключение модели

GigaChat — ваши ключи Сберакарточкой
OpenAI-совместимый адрескарточкой
YandexGPTпо запросу
Модель в вашем контуреобсуждаем

Что уже так, а чего нет

Слева — то, что работает сегодня. Справа — то, чего в платформе нет.

Работает

  • Разные модели на разные шаги: быстрая на реплику, сильная на разбор
  • Картинки — Gemini 3.1 Flash Image, она же «нанобанана»
  • Речь в текст — SaluteSpeech Сбера, Yandex SpeechKit вторым
  • GigaChat на ваших ключах — подключается в мастере
  • Повтор запроса, когда провайдер не ответил
  • Расход виден по каждому вызову: модель, токены, стоимость

Нет

  • Генерации видео: видеомоделей не подключено ни одной
  • Синтеза речи: сотрудник читает голосовое, но своим голосом не отвечает
  • Выбора модели на карточке сотрудника: уровень задаётся при сборке роли
  • Сравнений и рейтингов моделей: мы их не измеряли

Модель — деталь, а не продукт. Её можно поменять, и работа не остановится: роль, память, доступы и регламент останутся теми же.

Посмотрите на работу целиком

В записи видно каждый шаг: чем он его сделал и где остановился.