Ребзя, делюсь находкой, вдруг кому-то зайдет. Как уменьшить стоимость использования API OpenAI в 500 раз? Берете модель для эмбедингов text-embedding-3-small.
Важно: это не для диалогов, а для задач векторного поиска. Отлично заходит в RAG-системы или поиск по базам.
Пример из моей практики: подбор UI-блоков для лендингов. Допустим, запрос: «Хочу стильный блок для фитнес-приложения с расписанием тренировок». QDrant за доли секунды выдает топ-10 вариантов из библиотеки, где 100+ готовых блоков.
И знаете, сколько стоит один такой запрос? Одна копейка. Да, правда, через русские прокси. Но если работать напрямую с OpenAI, выйдет ещё дешевле.
На выходе — в 500 раз дешевле, чем использовать тот же 4o-mini.
Рогачев Дмитрий: ИТ бизнес без рокетсайн 🚀 https://t.me/itrubiz