🚀 Проект готов! Встречайте видео‑бота в Телеграме 👉
⸻
После недели экспериментов и подбора стека — бот по генерации видео в Телеграме готов к бою. Пиши текст, отправляй фото→ получай короткое видео 🎬
💭 Немного закулисья:
⸻
🧪 С чего всё началось
Начал с простого вопроса: где запускать inference быстро, гибко и не за конские деньги? Отправил вопрос в дип-ресёрч и получил отличный ответ — RunPod.
Это реально мощная платформа: • GPU on-demand • Очереди задач • Возможность подключать shared диск, который еще предоставляет импровизированный S3
https://runpod.io?ref=mghyh5x2
⸻
⚙️ Архитектура • Бэкенд бота — на моих же наработках, TypeScript + Hono.js + Supabase. Развёрнуто на Vercel в режиме serverless (да, Vercel умеет и Node.js вне Next.js, и на старте - бесплатно). • Воркеры — кастомный Docker-образ с: • подходящей версией PyTorch • правильным CUDA • доп. зависимостями для Wan2.2
Больше всего времени ушло как раз на сборку окружения для инференса.
⸻
🔥 Технический хайлайт
Удалось запустить Wan2.2 14B inference на RTX 5090 (32 GB VRAM) благодаря DFloat11-сжатию без потери качества. Это позволило уместить огромную модель в один GPU — и запускать видео за разумное время.
⸻
🎬 Бот уже работает, можно тестить прямо сейчас: 👉
В этом посте были ссылки, но мы их удалили по правилам Сетки