uz
Feedback
Derp Learning

Derp Learning

Kanalga Telegram’da o‘tish

Используем ИИ строго не по назначению. Заметки про ИИ, IT, компьютерные игры, и всякие инженерные интересности.

Ko'proq ko'rsatish

📈 Telegram kanali Derp Learning analitikasi

Derp Learning (@derplearning) Rus til segmentidagi kanali faol ishtirokchi. Hozirda hamjamiyat 13 846 obunachidan iborat bo'lib, Texnologiyalar & Aralashmalar toifasida 9 025-o'rinni va Rossiya mintaqasida 47 200-o'rinni egallagan.

📊 Auditoriya ko‘rsatkichlari va dinamika

невідомо sanasidan buyon loyiha tez o‘sib, 13 846 obunachiga ega bo‘ldi.

25 Avgust, 2026 dagi oxirgi ma’lumotlarga ko‘ra kanal barqaror faollikka ega. Oxirgi 30 kunda obunachilar soni 67 ga, so‘nggi 24 soatda esa 3 ga o‘zgardi va umumiy qamrov yuqori darajada qolmoqda.

  • Tasdiqlash holati: Tasdiqlanmagan
  • Jalb etish (ER): Auditoriya o‘rtacha 33.36% darajada jalb etiladi. Nashrdan keyingi dastlabki 24 soatda kontent odatda umumiy obunachilar sonining 16.75% ini tashkil etuvchi reaksiyalarni to‘playdi.
  • Post qamrovi: Har bir post o‘rtacha 4 618 marta ko‘riladi; birinchi sutkada odatda 2 319 ta ko‘rish yig‘iladi.
  • Reaksiyalar va o‘zaro ta’sir: Auditoriya faol: har bir postga o‘rtacha 77 ta reaksiya keladi.
  • Tematik yo‘nalishlar: Kontent git, wan, gpu, sparse, вайбкодинг kabi asosiy mavzularga jamlangan.

📝 Tavsif va kontent siyosati

Muallif resursni shaxsiy fikrni ifoda etish maydoni sifatida ta’riflaydi:
Используем ИИ строго не по назначению. Заметки про ИИ, IT, компьютерные игры, и всякие инженерные интересности.

Yuqori yangilanish chastotasi (oxirgi ma’lumot 26 Avgust, 2026 da olingan) sababli kanal doimo dolzarb va katta qamrovli bo‘lib qoladi. Analitika auditoriya kontent bilan faol hamkorlik qilishini, uni Texnologiyalar & Aralashmalar toifasidagi muhim ta’sir nuqtasiga aylantirishini ko‘rsatadi.

13 846
Obunachilar
+324 soatlar
-77 kunlar
+6730 kunlar
Postlar arxiv
GLM-5.3-flash (320b): выходит Qwen-3.8-flash-next:
+1
GLM-5.3-flash (320b): выходит Qwen-3.8-flash-next:

Не успел выйти Qwen3.8-flash-next, Unsloth уже грузит кванты :D https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF

photo content

Repost from La Qeque
photo content

Hugging face у нас дома (в Поднебесной) тизерит новый qwen3.8-next-flash. X
Hugging face у нас дома (в Поднебесной) тизерит новый qwen3.8-next-flash. X

photo content

Полгода работы прошли не зря! У нас (Keenable) публичный запуск. Новый сайт: https://keenable.ai/ Новый бенч: https://keenabl
Полгода работы прошли не зря! У нас (Keenable) публичный запуск. Новый сайт: https://keenable.ai/ Новый бенч: https://keenableai.github.io/needle/ Твит: https://x.com/styskin/status/2092265673041084505 Пост про бенч будет на неделе. Ещё будет одна прикольная штука, которая называется Web Query Language.

photo content

Еще интересный подход - взять драфтер токенов не из самого чекпоинта, а DFlash2 отсюда - Qwen3.8-27B-DFlash2-GGUF Для этого придется собрать llama.cpp:
git clone https://github.com/ggml-org/llama.cpp.git
cd llama.cpp
git fetch origin pull/27342/head:pr-27342
git switch pr-27342

# NVIDIA CUDA
cmake -B build -DCMAKE_BUILD_TYPE=Release -DGGML_CUDA=ON
cmake --build build -j

# Apple Silicon
cmake -B build -DCMAKE_BUILD_TYPE=Release -DGGML_METAL=ON
cmake --build build -j
Зато потом получаем 36.77 t/s с контекстом 100535 -> 52.15 t/s / 95k ctx llama-server.exe -m "Qwen3.8-27B-UD-Q3_K_XL.gguf" -md "Qwen3.8-27B-DFlash2-Q4_K_M.gguf" --alias qwen38 --port 8080 --ctx-size 95536 -ngl 99 -ngld 99 -fa on --cache-type-k q4_0 --cache-type-v q4_0 --jinja --reasoning-effort medium --no-context-shift --cache-reuse 256 --spec-type draft-dflash --spec-draft-n-max 3 -b 2048 -ub 512 --temp 1.0 --top-p 0.95 --top-k 20 --min-p 0.0 --tools all --parallel 1

photo content

thanks, 🧢
thanks, 🧢

люблю когда есть свобода выбора
люблю когда есть свобода выбора

photo content

Наконец дошли руки поковырять Qwen 3.8-27b Как говорится, мое увожение. На мои 16гб комфортно влез Qwen3.8-27B-UD-Q3_K_XL от unsloth --ctx-size 100535 -ngl 99 -fa on --cache-type-k q4_0 --cache-type-v q4_0 --jinja --reasoning-effort medium --no-context-shift --cache-reuse 256 --spec-type draft-mtp --spec-draft-n-max 1 -b 2048 -ub 512 --temp 1.0 --top-p 0.95 --top-k 20 --min-p 0.0 --tools all выдает 36.77 t/s с контекстом 100535 Еще есть интересный дистилл Qwen3.8-2.4T-A95B -> Qwen 3.5 9b С Qwen3.8-9B-Q8_0 и конфигом --ctx-size 262144 -ngl 99 -fa on --cache-type-k q8_0 --cache-type-v q8_0 --jinja --reasoning-effort low --no-context-shift --cache-reuse 256 --spec-type draft-mtp --spec-draft-n-max 3 -b 2048 -ub 512 --temp 1.0 --top-p 0.95 --top-k 20 --min-p 0.0 --tools all выдает 85+ t/s с контекстом 262144 В llama.cpp ui / aider ваншотят игры вроде scorched earth, но 9b модель чаще спотыкается. Можно гонять и через claude code/codex, но codex использует новый более сырой апи и одним своим системным промтом сжирает 20к+ токенов :D llama.cpp тут

Таким должен был быть трейлер Red Alert 2 Ладно, забирайте эту вашу оперативку x автор: https://www.douyin.com, lyxw1327

photo content

photo content

Repost from Dev Meme / devmeme
photo content