🚀 Проект готов! Встречайте видео‑бота в Телеграме 👉

После недели экспериментов и подбора стека — бот по генерации видео в Телеграме готов к бою. Пиши текст, отправляй фото→ получай короткое видео 🎬

💭 Немного закулисья:

🧪 С чего всё началось

Начал с простого вопроса: где запускать inference быстро, гибко и не за конские деньги? Отправил вопрос в дип-ресёрч и получил отличный ответ — RunPod.

Это реально мощная платформа: • GPU on-demand • Очереди задач • Возможность подключать shared диск, который еще предоставляет импровизированный S3

https://runpod.io?ref=mghyh5x2

⚙️ АрхитектураБэкенд бота — на моих же наработках, TypeScript + Hono.js + Supabase. Развёрнуто на Vercel в режиме serverless (да, Vercel умеет и Node.js вне Next.js, и на старте - бесплатно). • Воркеры — кастомный Docker-образ с: • подходящей версией PyTorch • правильным CUDA • доп. зависимостями для Wan2.2

Больше всего времени ушло как раз на сборку окружения для инференса.

🔥 Технический хайлайт

Удалось запустить Wan2.2 14B inference на RTX 5090 (32 GB VRAM) благодаря DFloat11-сжатию без потери качества. Это позволило уместить огромную модель в один GPU — и запускать видео за разумное время.

🎬 Бот уже работает, можно тестить прямо сейчас: 👉


В этом посте были ссылки, но мы их удалили по правилам Сетки

🚀 Проект готов! Встречайте видео‑бота в Телеграме
👉
⸻
После недели экспериментов и подбора стека — бот по генерации видео в Телеграме готов к бою | Сетка — социальная сеть от hh.ru