Монография “Reinforcement Learning: An Overview”Исчерпывающий материал по обучен…

📌Монография “Reinforcement Learning: An Overview” Исчерпывающий материал по обучению с подкреплением (Reinforcement Learning, RL), в котором подробно описываются различные модели среды, задачи оптимизации, исследуется определение компромисса между теорией и практической…

OLMo 2: Новое поколение полностью открытых языковых моделей.OLMo 2 – серия откр…

🌟 OLMo 2: Новое поколение полностью открытых языковых моделей. OLMo 2 – серия открытых языковых моделей, созданная для развития науки о языковых моделях . Модели OLMo 2 доступны в вариантах…

Wavehax: нейросетевой вокодер без эффекта наложения частот.Wavehax – нейросетев…

🌟 Wavehax: нейросетевой вокодер без эффекта наложения частот. Wavehax – нейросетевой вокодер, который синтезирует аудиосигналы без искажений, вызванных наложением частот. Эта проблема часто возникает в моделях, работающих во временной области,…

RLtools: самая быстрая библиотека глубокого обучения с подкреплением для задач …

🌟 RLtools: самая быстрая библиотека глубокого обучения с подкреплением для задач непрерывного управления. RLtools – библиотека глубокого обучения с подкреплением (Deep Reinforcement Learning, DRL) с высокой скоростью работы для разработки…

Туториал по файнтюну Qwen2-VL-7B с использованием экосистемы Hugging Face.Статья…

📌Туториал по файнтюну Qwen2-VL-7B с использованием экосистемы Hugging Face. Статья на HF из цикла Open-Source AI Cookbook c подробным пошаговым описанием и примерами кода процесса тонкой настройки VLM Qwen2-VL-7B в…

LLaMA-Mesh: метод генерации 3D-мешей с помощью LLM.LLaMA-Mesh – метод, разработ…

🌟 LLaMA-Mesh: метод генерации 3D-мешей с помощью LLM. LLaMA-Mesh – метод, разработанный NVIDIA Labs, позволяющий генерировать 3D-модели с помощью текстовых инструкций, используя LLM. В отличие от других методов, LLaMA-Mesh представляет…

AdaCache: ускорение DiT в генерации видео через необучаемое адаптивное кэширова…

🌟 AdaCache: ускорение DiT в генерации видео через необучаемое адаптивное кэширование. AdaCache основан на наблюдении, что «не все видео одинаковы»: некоторым видео требуется меньше шагов денойза для достижения приемлемого качества,…

D-FINE: метод регрессии bounding box в детекторах объектов на основе DETR.D-FIN…

🌟 D-FINE: метод регрессии bounding box в детекторах объектов на основе DETR. D-FINE – детектор объектов в режиме реального времени, который предлагает улучшение регрессии bounding box в моделях DETR .…

Llama-3.1-Centaur-70B: модель симуляции поведения человека.Centaur – модель, ко…

🌟 Llama-3.1-Centaur-70B: модель симуляции поведения человека. Centaur – модель, которая способная предсказывать и симулировать поведение человека в любом психологическом эксперименте, который можно описать на естественном языке. Это первая модель, соответствующая…

SHORTCUT MODELS: метод обучение диффузионных моделей генерации в 1 шаг.Shortcut…

🌟 SHORTCUT MODELS: метод обучение диффузионных моделей генерации в 1 шаг. Shortcut models – метод обучения диффузионных моделей, который позволяет генерировать изображения высокого качества за один или несколько шагов. В…