Первичная настройка
Yttri работает с личными данными: почтой, заметками, встречами, финансами. Поэтому настройка сводится к одному вопросу — какая модель какие ваши данные видит. Всё остальное вторично.
Порядок, в котором стоит пройти настройку:
- Аккаунт и подписка — что вообще доступно.
- Основная модель — кто отвечает в диалоге.
- Встроенная модель — нужна ли она и потянет ли устройство.
- Роутер и фоновые задачи — самое важное решение по приватности.
Первый запуск
Заголовок раздела «Первый запуск»После авторизации приложение проводит через несколько экранов. Пропустить можно в любой момент.
Проверка моделей. Экран проверяет две вещи по отдельности: облачный AI и встроенную модель для фоновых задач. Для облака показывается задержка в миллисекундах, для встроенной — доступна ли она на этом устройстве. Ошибки конкретные: превышен лимит запросов, исчерпан бюджет тарифа, провайдер недоступен, нужна переавторизация. Рядом кнопки «Проверить снова», «Скачать модель заново», «Использовать облако».
Звук. Проверка микрофона и системного звука — для записей и встреч.
Фоновые задачи и приватность. Экран объясняет, что это за задачи и почему для них предпочтительна встроенная модель. Если подходящего GPU нет, вместо объяснения появляется выбор: обрабатывать фон через облако (работают все функции, расходуются токены подписки) или отключить (без расхода токенов, но без авто-тегов, сводок, извлечения фактов и проактивных подсказок).
Анкета. Шесть шагов: имя, роль, над чем работаете, стиль общения, интересы, подключение почты. Из ответов собирается первичный профиль, на который агент опирается в ответах. Шаг с почтой можно пропустить и сделать позже — пошагово по каждому провайдеру в «Подключении почты».
Сводка. Статус по пунктам: подписка, облачный AI, встроенная модель, звук, почта — каждый со ссылкой в нужный раздел настроек.
Аккаунт и подписка
Заголовок раздела «Аккаунт и подписка»Настройки → Аккаунт.
Подписка: план, статус (пробный период, активна, отменена, истекла, просрочена), дата окончания. Кнопка «Изменить план» открывает страницу управления, «Обновить статус подписки» перепроверяет её принудительно.
Облачные модели доступны при активной подписке или триале. Без неё приложение работает в бесплатном режиме: локальные функции остаются, облачный AI выключен.
Офлайн. Без интернета подписка не проверяется — действует grace-период с обратным отсчётом. Приложение честно пишет, что статус подтвердить не удалось, вместо того чтобы молча отключить AI.
Карта оплаты: дата следующего списания, отключение автопродления, отвязка карты. При неудачном списании появляется баннер — доступ сохраняется до конца оплаченного периода.
Основная модель
Заголовок раздела «Основная модель»Настройки → Ассистент → вкладка «Модели».
Основная модель отвечает вам в диалоге. Вариантов два:
- Yttri Cloud — облачный AI от Yttri: ключей вводить не надо, модель выбирать не надо;
- свой провайдер — любой сервис с совместимым API, включая ваш собственный сервер.
Рядом — «Проверить соединение»: проверяет именно текущий выбор и показывает задержку либо текст ошибки.
Свой провайдер
Заголовок раздела «Свой провайдер»Диалог добавления — пять полей:
| Поле | Что вводить |
|---|---|
| Имя | как провайдер будет называться в списках |
| Тип API | Chat Completions (OpenAI-совместимый), Messages API (Anthropic) или Responses API (OpenAI) |
| Base URL | полный базовый URL — приложение само добавит конечный сегмент |
| API-ключ | не обязателен для локальных серверов |
| Локальный провайдер | определяется по адресу, переключается вручную |
В диалоге есть своя проверка соединения — до сохранения. Удаление провайдера удаляет и его API-ключ; если он был активным, активным станет Yttri Cloud.
Для не-облачных провайдеров ниже появляется выбор модели, длина контекста, максимум выходных токенов и уровень reasoning effort. Параметры подставляются по справочнику моделей, а если модели там нет — задаются вручную.
Свой инференс: LM Studio, Ollama, LiteLLM
Заголовок раздела «Свой инференс: LM Studio, Ollama, LiteLLM»Локальный сервер подключается как обычный провайдер: тип API — Chat Completions, Base URL — адрес сервера, ключ обычно не нужен.
Флаг «Локальный провайдер» проставляется по адресу автоматически:
localhost, 127.0.0.1, ::1, *.local и приватные диапазоны 10.*,
192.168.*, 172.16–31.*. Всё остальное считается внешним.
Пошагово — LM Studio, Ollama и свой шлюз для нескольких моделей (например, LiteLLM в Docker).
Встроенная модель
Заголовок раздела «Встроенная модель»Настройки → Ассистент → «Модели» → «Встроенная модель».
Qwen3.5-4B, поставляемая с приложением. Отвечает за фоновую обработку и внутренние маршруты, но не за диалог.
Варианты: стандартная версия (GGUF), версия для Apple Silicon (MLX) и «Не выбрано» — тогда внутренние маршруты, завязанные на неё, не выполняются.
Требования проверяются автоматически, и при несовпадении приложение называет причину: мало оперативной памяти, Intel Mac не поддерживается, нет дискретной NVIDIA GPU, у видеокарты меньше 8 ГБ VRAM, сборка Linux только на CPU, файл модели не найден или повреждён.
Модель скачивается кнопкой — около 3,2 ГБ, в фоне. На Windows дополнительно нужен CUDA-рантайм (около 450 МБ) и перезапуск приложения после установки.
Отдельно в этой же вкладке назначаются модель распознавания голоса (ASR) и модель генерации голоса (TTS) — они скачиваются по требованию, прогресс и ошибки видны в строке.
Распознавание речи и озвучивание используют отдельные локальные модели, не связанные с выбором основной. Обработка речи идёт на устройстве — ещё один довод, чтобы записи встреч не уезжали в облако.