Агенты ИИ | AGI_and_RL
ТехнологииПро ии, RL и в целом @tokarev_i_v https://t.me/researchim
Мониторьте этот канал — посты, тренды, конкуренты
Обзор канала
- Платформа Telegram
- Категория Технологии
- Подписчики 6 170
- Температура Горячий
- Постов/день 0.5
- Тип Публичный
Динамика подписчиков
Это ваш канал?
Подключите TeleGraphyx Traffic и получайте целевых подписчиков от 15₽. Интеграция с Яндекс.Директ, готовые лендинги, ежедневные отчёты.
Вовлечённость (ERR)
Анализ публикаций
30 днейТипы контента
Популярные посты
Квены потренили Qwen 3.5 4B для автопилота, только добавили к нему голову в которую 3D данные со сцены заходят (BEV Perception Head) + добавлен planning expert это 32 слоя диффузионного трансформера
Алибаба потюнили Qwen 3.6-35B-A3B чтобы он лучше обслуживал аватара на стримах нуи в целом схема как там устроено все на скрине, прикольно Training Agents to Evolve with Their Harness: TaoLive Digita
автор пишет что потренил трансформер на 28м параметров за 1.5 часа на 5090 и выбил 44% на ARC-AGI-1 https://mvakde.github.io/blog/44-on-arc-1/ https://github.com/mvakde/mdlARC/
прикольное про трен мелких моделек Авторы рассказывают как претренили 2B модельки на кластере 5090 (24x5090 на первой фазе за $4.4k и 96x5090 на второй за $6.9k) и достигли перформа Qwen2-1.5B Puro
там рлем учат тот самый мозг мухи играть в beat saber https://x.com/_lyraaaa_/status/2097527368919470162
Кстати я тут завел бусти если у кого-то появится желание поддержать то чем мы занимаемся в https://t.me/researchim то вот 🥰🪳 https://boosty.to/researchim
Небольшой апдейт по студии https://github.com/researchim-ai/reinforcement-studio туда добавлены некоторые multi agent rl алгоритмы world models и алгоритмы которые с ними работают efficient zero v2 (н
Пока ходил искал алгоритмы которые в студию завести полезно собрал список *Zero алгоритмов Mastering Chess and Shogi by Self-Play with a General Reinforcement Learning Algorithm https://arxiv.org/abs
Майкрософты потюнили 4B Qwen-3.5 на 61.5% Swe-bench verified чисто генерацией задач и рлем FrogNano: Training a 4B Coding Agent via Online Task Synthesis https://microsoft.github.io/debug-gym/static
Достаточно нишевая инфа про скейлинг ллмного рля на Jax для TPU но мб вам интересно https://adityamakkar000.github.io/posts/async-rl-jax.html
Похожие каналы
Подобраны AI по тематике и контенту
Обзор канала
- Платформа Telegram
- Категория Технологии
- Подписчики 6 170
- Температура Горячий
- Постов/день 0.5
- Тип Публичный
Продвижение канала
Хотите контент как у лучших? AI сделает
AI изучит стиль топовых каналов в нише и создаст уникальные посты, обложки и стратегию для вашего канала. Полный автопилот — от идеи до публикации.
Подписывайтесь на наши каналы
Кейсы, лайфхаки и новости о продвижении в мессенджерах