Агенты ИИ | AGI_and_RL
رفتن به کانال در Telegram
Про ии, RL и в целом @tokarev_i_v https://t.me/researchim
نمایش بیشتر6 136
مشترکین
+224 ساعت
+57 روز
+3330 روز
در حال بارگیری داده...
کانالهای مشابه
ابر برچسبها
اشارات ورودی و خروجی
---
---
---
---
---
---
جذب مشترکین
اوت '26
اوت '26
+107
در 2 کانالها
ژوئیه '26
+133
در 0 کانالها
Get PRO
ژوئن '26
+135
در 0 کانالها
Get PRO
مه '26
+121
در 0 کانالها
Get PRO
آوریل '26
+130
در 3 کانالها
Get PRO
مارس '26
+184
در 2 کانالها
Get PRO
فوریه '26
+160
در 3 کانالها
Get PRO
ژانویه '26
+117
در 3 کانالها
Get PRO
دسامبر '25
+117
در 2 کانالها
Get PRO
نوامبر '25
+120
در 0 کانالها
Get PRO
اکتبر '25
+166
در 3 کانالها
Get PRO
سپتامبر '25
+124
در 2 کانالها
Get PRO
اوت '25
+127
در 0 کانالها
Get PRO
ژوئیه '25
+156
در 7 کانالها
Get PRO
ژوئن '25
+206
در 5 کانالها
Get PRO
مه '25
+157
در 1 کانالها
Get PRO
آوریل '25
+239
در 4 کانالها
Get PRO
مارس '25
+291
در 7 کانالها
Get PRO
فوریه '25
+314
در 5 کانالها
Get PRO
ژانویه '25
+422
در 11 کانالها
Get PRO
دسامبر '24
+334
در 8 کانالها
Get PRO
نوامبر '24
+95
در 0 کانالها
Get PRO
اکتبر '24
+132
در 1 کانالها
Get PRO
سپتامبر '24
+81
در 3 کانالها
Get PRO
اوت '24
+140
در 3 کانالها
Get PRO
ژوئیه '24
+748
در 2 کانالها
Get PRO
ژوئن '24
+99
در 3 کانالها
Get PRO
مه '24
+86
در 0 کانالها
Get PRO
آوریل '24
+307
در 8 کانالها
Get PRO
مارس '24
+186
در 3 کانالها
Get PRO
فوریه '24
+76
در 1 کانالها
Get PRO
ژانویه '24
+92
در 1 کانالها
Get PRO
دسامبر '23
+98
در 3 کانالها
Get PRO
نوامبر '23
+93
در 2 کانالها
Get PRO
اکتبر '23
+80
در 2 کانالها
Get PRO
سپتامبر '23
+139
در 0 کانالها
Get PRO
اوت '23
+78
در 0 کانالها
Get PRO
ژوئیه '23
+127
در 0 کانالها
Get PRO
ژوئن '23
+113
در 0 کانالها
Get PRO
مه '23
+1 856
در 0 کانالها
| تاریخ | رشد مشترکین | اشارات | کانالها | |
| 31 اوت | +6 | |||
| 30 اوت | +6 | |||
| 29 اوت | +3 | |||
| 28 اوت | +4 | |||
| 27 اوت | +1 | |||
| 26 اوت | +2 | |||
| 25 اوت | +4 | |||
| 24 اوت | +4 | |||
| 23 اوت | +6 | |||
| 22 اوت | +6 | |||
| 21 اوت | +1 | |||
| 20 اوت | +2 | |||
| 19 اوت | +5 | |||
| 18 اوت | +1 | |||
| 17 اوت | +3 | |||
| 16 اوت | +2 | |||
| 15 اوت | +2 | |||
| 14 اوت | +5 | |||
| 13 اوت | +3 | |||
| 12 اوت | +7 | |||
| 11 اوت | +5 | |||
| 10 اوت | +3 | |||
| 09 اوت | +3 | |||
| 08 اوت | +5 | |||
| 07 اوت | +1 | |||
| 06 اوت | +4 | |||
| 05 اوت | +4 | |||
| 04 اوت | +2 | |||
| 03 اوت | +1 | |||
| 02 اوت | +2 | |||
| 01 اوت | +4 |
پستهای کانال
Кстати я тут завел бусти если у кого-то появится желание поддержать то чем мы занимаемся в https://t.me/researchim то вот 🥰🪳
https://boosty.to/researchim
| 2 | прикольное про трен мелких моделек
Авторы рассказывают как претренили 2B модельки на кластере 5090 (24x5090 на первой фазе за $4.4k и 96x5090 на второй за $6.9k) и достигли перформа Qwen2-1.5B
Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090
https://arxiv.org/abs/2608.27370
https://www.alphaxiv.org/ru/abs/2608.27370
https://huggingface.co/collections/thu-pacman/puro-2b | 827 |
| 3 | машинка научилась ездить по трассе, хз что еще нужно
в той рл студии за 40 минут | 1 479 |
| 4 | еще квеновое приехало 125B A6B + 51B
наверное как дипсик флеш должно быть по уму. я попозже тоже попробую
https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF
кто будет гонять отпишитесь потом | 1 521 |
| 5 | начал делать локальную студию для RLя (потому что все должны рлить)
там добавлены сейчас 88 енвов, ерализованы многие популярные алгоритмы
также алгоритмов добавлена память на LSTM/GRU
есть селф-плей alphazero с несколькими средами
есть возможность запускать несколько параллельных сред для одного эксперимента
https://github.com/researchim-ai/reinforcement-studio
пока что просто показываю.
где-нибудь в конце этой недели или на следующей мб будет билд уже под linux/windows, чтобы можно было с кайфом потыкать
в общем-то оно и сейчас работает вроде бы но надо потестить еще + некоторые фичи допиливаются
вообще эта штука делается как ответвление моделек дома https://github.com/researchim-ai/models-at-home чисто под rl
модельки дома тоже потихонечку переезжаются на свою прилу https://github.com/researchim-ai/models-at-home-studio
я туда хотел запихнуть страницу с "маленьким рлем". но как будто тут отдельная штука нужна была ну и я решил делать | 1 678 |
| 6 | Буквально лучший поиск, один из самых быстрых дешвле соседей и с тем же качеством
keenable.ai - юзать отсюда и всем по 100к бесплатных поисков на месяц релиза
поддерижите в твиттере запуск
techcrunch | 992 |
| 7 | Полгода работы прошли не зря!
У нас (Keenable) публичный запуск.
Новый сайт: https://keenable.ai/
Новый бенч: https://keenableai.github.io/needle/
Твит: https://x.com/styskin/status/2092265673041084505
Пост про бенч будет на неделе. Ещё будет одна прикольная штука, которая называется Web Query Language. | 1 |
| 8 | Q-Learning With World Models
https://arxiv.org/abs/2608.17163
https://www.alphaxiv.org/abs/2608.17163 | 1 591 |
| 9 | добавил в однокликового ресечагента qwen 3.8 27B
моделька очень крутая но много думает и говорят иногда может подчистить вам всю репу
если кто хочет попробовать
https://github.com/researchim-ai/one-click-research-agent/releases/tag/v0.1.4
сам репозиторий
https://github.com/researchim-ai/one-click-research-agent
по багам или предложениям сюда
https://t.me/researchim | 1 993 |
| 10 | https://artificialanalysis.ai/models/qwen3-8-27b
думайте | 2 585 |
| 11 | Забираем, тестим, отписываем что да как
https://huggingface.co/Qwen/Qwen3.8-27B | 2 993 |
| 12 | завтра уже https://huggingface.co/Qwen/Qwen3.8-27B | 2 497 |
| 13 | ля вот и DeepSeek-V4-Pro-0813 1.57T A48B
https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro-0813
гуфы тут будут
https://huggingface.co/unsloth/DeepSeek-V4-Pro-0813-GGUF
я даже хз что и сказать. ни дня без крутого релиза
все еще ждем 27б квен | 2 275 |
| 14 | А вот и Qwen 3.8 2.4T
релизы крутые в последнее время конечно
гуфы
https://huggingface.co/unsloth/Qwen3.8-2.4T-A95B-GGUF
самому негде запускать это
ждем 27B модельку которую тоже обещали | 2 148 |
| 15 | Обновил ресеч агента на квенах
Это для тех кто хотел бы работать на своей тачке с локальными модельками
теперь добавился режим с поиском инфы по разным источникам (научным типа архива и опеналекс) и по вебу с отчетом по результатам
типа дипресеча - задаете ему тему например поиск статей, можно задать временные рамки, сколько источников в отчете должно быть и он будет искать
https://github.com/researchim-ai/one-click-research-agent
тут приложения
https://github.com/researchim-ai/one-click-research-agent/releases/tag/v0.1.2
рекомендую все же qwen 3.6 35b использовать
попробую заточить под 9b тоже, но посмотрим
все проекты делаются тут https://t.me/researchim | 2 819 |
| 16 | кажется неплохой дроп от дипсиков - апдейт для v4 flash
https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731
ggufы уже готовятся
https://huggingface.co/unsloth/DeepSeek-V4-Flash-0731-GGUF | 2 861 |
| 17 | Нужна ваша помощь! 👀👀👀
Мы, Steelman Labs, написали наш первый блог-пост: о том, что не так с computer use и как мы это решаем. А ещё выложили красивый демо-видос.
https://x.com/SteelmanLabs/status/2082789336995528727?s=20
Большая просьба помочь хайпом в твиттере и лайком на HN
https://news.ycombinator.com/item?id=49108542 | 1 937 |
| 18 | ну штош выложили веса Kimi K3 (2.8TA104b) - это который фейбл дома
наверное самый важный релиз со времен квенов 3.5, правда совсем другой весовой категории
муншоты легенды🥰
именно для таких релизов нужны OpenAI, Anthropic и все остальные
жаль в 3090 не влезет
https://www.kimi.com/blog/kimi-k3
https://github.com/MoonshotAI/Kimi-K3/blob/main/k3_tech_report.pdf
веса
https://huggingface.co/moonshotai/Kimi-K3 | 3 028 |
| 19 | про ризонинге и как уровень рассуждений контролировать и настраивать в ллм
https://magazine.sebastianraschka.com/p/controlling-reasoning-effort-in-llms | 3 156 |
| 20 | Чел показывает как потюнить ллмку рлем чтобы она тюнила маленькие ллмки рлем, прикольно
https://github.com/Danau5tin/ai-trains-ai | 3 442 |
