и посмотреть медиа
Berloga - науки и технологии
и посмотреть медиа
Data Science, Биология, Математика, Физика, IT и Computer Science.
Data Science, Биология, Математика, Физика, IT и Computer Science.
Мультидисциплинарный канал о науке и технологиях. Темы включают Data Science, Биоинформатику, Биологию, Математику, Физику, IT и Computer Science. Подробные материалы для профессионалов и энтузиастов.
Запилили открытый учебник по Reinforcement Learning — от жадных бандитов до выравнивания LLM. Идея — собрать в одну книгу путь от классической теории RL до современных RLHF-пайплайнов и reasoning-моделей. 320 страниц, 17 глав в 4 частях: 1. Основы: бандиты, MDP, DP, Monte Carlo, TD-learning 2. Глубокое RL: DQN, policy gradient, actor-critic, PPO с GAE 3. RLHF и выравнивание: модели вознаграждения, DPO/IPO/KTO/ORPO, GRPO, RLVR 4. Настоящий фронтир уровень: reasoning, chain-of-thought, агентные и мультиагентные системы + их обучение К каждой главе идет Jupyter-ноутбук (запускается в бесплатном Colab) и задачи с решениями. Внутри - разбор кейсов InstructGPT, Llama 2, Constitutional AI и DeepSeek-R1. Есть черновой перевод на русский. По материалу уже готовились (и успешно прошли) собесы в топ-компании на hard-RL секции, а скоро его пустят в печать Если зайдёт — буду благодарен звезде на GitHub ⭐️ так учебник смогут найти новые люди через рекомендации платформы гитхаб и перевод на русский 🏔 Сообщество ML-энтузиастов и AI в горах Телеграм: @mountainai_info Сайт: Ссылка скрыта
Открыть канал и посмотреть медиаOnly registered users can share their opinion.
Be the first to share your impression of this resource!
Information on NUST joint projects«MISIS»CERN, including the New Technologies for the Search for New Physical Effects program.
MagnetBrainsLessons for kindergarten up to 12th grade,IITJEE, NEET and state exams. 100% quality in Telegram.
Channel with JEE trial papersMains2025, past tests and solutions for effective exam preparation.