Летом 2025 года, я уже имел опыт работы с различными моделями, успел поработать с GPT-4o, GPT-3.5-turbo. Это были интересные эксперименты, но на тот период я не думал о том что LLM вырастут так быстро что смогут собрать полноценный большой проект. Основной моей болью в тот момент были бесконечные рабочие "созвоны", настольная записная книжка, перечитывать которую в конце недели приходилось по несколько раз. Терялись детали, забывались мелочи в разговорах брошенные между делом.

Первым проектом что я задумал стала обыкновенная запись разговоров во время "созвонов" их транскрибирация (распознание речи) и создание по ним саммари (краткие выводы и детали). Собирать проект решил на Electron, в тот момент уже хорошо с ним знаком и имел огромный опыт работы с JavaScript. В помощники я взял Copilot GitHub и стал собирать проект руками. Очень скоро я пришел к тому, что на такой казалось бы простой проект уйдет достаточно много времени и я решил попробовать вайбкодинг. Смотрел что делал агент, поправлял, дописывал, доделывал. В целом получилось и достаточно неплохо. ASR (модель распознания речи) была Whisper, ну а для саммаризации я взял тогда бесплатный вариант на ollama oss-gpt-120b - она хорошо делала свою работу.

За несколько недель накопилось достаточно много записей приведенных уже в markdown формат. Ну не хранить же их в файлах, решил запихать их в Obsidian. Еще через неделю я уже заводил задачи, писал документацию в виде заметок. Перепробовал в пару десятков разных плагинов и пришел к выводу что мне этого не то что мало, это прям сильно не удобно, и постоянно хочется еще и еще и вот тут не так, и т.п.

И так родился Yttri, первым его названием было AI-Helper. Идея была простая собрать мои наработки по записи разговоров, добавить туда заметки и агентские функции. Почти сразу я понял что Electron для такой задачи не подходит и я перешел на Tauri с Rust. Несколько недель ушло на изучение языка и документаций, за плечами уже был опыт и Dart, Go, Java, так что дело спорилось.

Итого к осени примерно к концу ноябрю я собрал первый очень сырой и ели ели работающий прототип.

Мои требования и идея возникали одна за одной, и казалось не сложно - вот тут прикрутил, тут добавил и всё очень скоро получится как нужно. Добавил почту, работу с документами, работу с диаграммами mermaid, plantuml. Документацию стало писать проще и быстрее поиск материалов уже не был таким сложным.

В феврале 2026 года, я решил что нужно попробовать показать это творение пользователям, потому что мне это нравилось, было удобным, простым и понятным. Я собрал быстро сайт, написал статью на Хабре (ее кстати спустя пол года при изменении политики, забанили за рекламу), получил большой отклик и интерес от аудитории. Понял что нужно доводить до ума.

Основная концепция зиждилась на Local fist - т.е. данными владеет пользователь, никто и никак не должен использовать его данные без его согласия. Очень скоро я понял что одна встроенная локальная модель тогда это была qwen3 2b не вывезет такие задачи и оборудование не у всех пользователей способно переваривать запуск локальных моделей. Так родился Yttri Cloud - свой облачный интегратор больших моделей. В данный момент на нем работает и несколько моделей, но выбор у пользователя остается.

К лету 2026 года, я доработал дизайн, добавил Yttri Meet (отдельное решение для звонков), доработал локальные инференсы встроенных моделей. Появились модели которые могут работать на CPU в том числе embedding, asr, tts, reranker, ocr и при наличие GPU в том или ином виде Qwen3.5 4b. Написал свою обвязку для запуска моделей, донором выступил candle от hugging face. Но для mac'ов на Apple Silicon пришлось изучить swift и сделать полноценный компонент для работы с MLX версиями. Для маков это нативно, быстрее и эффективней.

В данный момент приложение всё еще проходит бета тестирование, обросло множеством полезных функций. У меня еще много идей для его развития.

А почему я решил поделиться этим сейчас, да видимо время пришло.

Yttri сейчас работает на mac, windows, linux, интегрирован с Telegram.

https://yttri.online/

Летом 2025 года, я уже имел опыт работы с различными моделями, успел поработать с GPT-4o, GPT-3.5-turbo | Сетка — социальная сеть от hh.ru