LLM-агент
AutoML_LLM_agent
LLM-агент, оркеструющий полный ML-пайплайн для оценки цены товаров: модель решает, что делать с пропусками, какие признаки генерировать и какую модель с гиперпараметрами выбрать, а детерминированные Python-ноды выполняют работу. Были проведены тесты с разными моделями, техниками промптинга и параметрами генерации.
LangGraphLLM_Agents
Открыть репозиторий
POST-TRAIN
LUFFY post-train
Учебная работа по воспроизведению LUFFY (Learning to reason Under oFF-policY guidance): mixed-policy GRPO, смешивающий собственные rollout'ы модели с off-policy трассами рассуждений более сильного учителя через регуляризованный importance sampling — чтобы модель училась у учителя, не скатываясь в поверхностное копирование.
RLGRPO
Открыть репозиторий
PRODUCTION
BookBot
Telegram-бот, автоматизирующий запись клиентов офлайн-бизнеса поверх Google Calendar: клиенты записываются и отменяют записи прямо в диалоге, а сотрудники управляют услугами, мастерами и отзывами из админ-панели — всё синхронизируется с базой на SQLAlchemy.
TelegramSQLAlchemyAPI
Открыть репозиторий