Код в мешке
Ir al canal en Telegram
Код в мешке - про кодинг, и не только... Это личная записная книжка https://t.me/joinchat/AAAAAEIy6oGlr8oxqTMS5w
Mostrar más264
Suscriptores
Sin datos24 horas
+37 días
+1030 días
Archivo de publicaciones
263
Repost from Типичный программист
CUDA готова пустить к себе RISC-V, если платформа дорастёт до серверной
Процессор, который раздаёт видеокарте работу в CUDA, может быть только x86-64 или aarch64. На Hot Chips 2026 Nvidia назвала условия, при которых к ним добавится RISC-V.
Требования серверные: профиль RVA23, спецификации RISC-V для серверного SoC и платформы, поддержка ACPI, через которую система узнаёт у железа, что оно умеет, и когерентность PCIe.
Последний пункт объясняет, почему дешёвой платформой не отделаться. Без когерентности процессор записал данные, а они ещё лежат в его кэше; копирование в память видеокарты идёт мимо процессора, прямо из DRAM, и утаскивает устаревшую версию. Спасают только ручные сбросы кэшей на каждой передаче.
Чего Nvidia хочет от векторных расширений, разбирают в Chips and Cheese.
263
Repost from Типичный программист
Есть один разработчик, который искренне верит, что отпуск случится сразу после релиза. Проблема в том, что релизы у него не заканчиваются никогда. 😅
Сам он с места не сдвинется, поэтому нужна ваша помощь. В новой мини-игре вам предстоит разгрести бардак, найти билет, собрать чемодан и приодеть программиста для отпуска. Заодно собирайте промо-коды от партнёров!
Играть
263
Repost from Типичный программист
Разработчик собрал фоторедактор, который ни разу не отправляет фото на сервер
Любая онлайновая удалялка фона работает одинаково: вы загружаете снимок, модель крутится на чужой машине, вы забираете результат. Копия уже ушла, и что с ней дальше, вам не расскажут. В APIC-Web фон, объекты, фильтры, конвертация и сжатие живут прямо в браузере, на Canvas, WebAssembly и локальной модели.
Вырезать фон просто, пока в кадре нет волос. Очевидный путь через ImageSegmenter из MediaPipe с флагом outputCategoryMask отдаёт на пиксель жёсткий ноль или единицу. По волосам получается лесенка, и размытием её не спасти: промежуточные значения округлились и потерялись.
Приём в том, чтобы забрать вероятности до округления. Флаг outputConfidenceMasks отдаёт на пиксель число от нуля до единицы, и дальше край собирается в несколько шагов. Модель та же, край другой.
Грабли: число каналов уверенности у моделей разное, так что проверяйте длину массива вместо confidenceMasks[1]. Оба сложных куска редактора расписаны с кодом.
263
📙 Cactus Needle 2 — 14 МБ агентная LLM для устройств без GPU
Обзор Needle 2 от Cactus Compute: открытая модель на 45М параметров и 14 МБ для вызова функций на устройствах умного дома, роботах и носимой электронике.↘️ Needle 2 - The 14 MB Agentic LLM for Tiny Devices | Cactus Today we release Needle 2: an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs in 28MB of RAM. It is built on our Simple Attention Network, compressed to CQ2-bit with Cactus Quants, and baked into its own engine. Cactus-Compute/needle2 · Hugging Face Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs a full session in 28MB of RAM. It is built on our Simple Attention Network findings, compressed ... GitHub - cactus-compute/needle: 14MB foundation model for tiny devices; phones, wearables, smart home, and robots Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs a full session in about 28MB of RAM. needle/README.md at main · cactus-compute/needle Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs a full session in about 28MB of RAM.
263
needle/README.md at main · cactus-compute/needle
Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs a full session in about 28MB of RAM.
263
Cactus Needle 2 — 14 МБ агентная LLM для устройств без GPU ...
Aug 11, 2026 · Обзор Needle 2 от Cactus Compute: открытая модель на 45М параметров и 14 МБ для вызова функций на устройствах умного дома, роботах и носимой электронике. Архитектура, квантование и результаты бенчмарков.
263
GitHub - cactus-compute/needle: 14MB foundation model for tiny devices; phones, wearables, smart home, and robots. · GitHub
2 days ago - Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs a full session in about 28MB of RAM.
263
Cactus-Compute/needle2 · Hugging Face
1 month ago - Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs a full session in 28MB of RAM. It is built on our Simple Attention Network findings, compressed ...
263
Needle 2 - The 14 MB Agentic LLM for Tiny Devices | Cactus
Today we release Needle 2: an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs in 28MB of RAM. It is built on our Simple Attention Network, compressed to CQ2-bit with Cactus Quants, and baked into its own engine.
263
Repost from Content-Review.com
Цифра дня
Всего 14 мегабайт весит языковая модель, которая может управлять устройством. Needle 2 от стартапа Cactus состоит из 45 миллионов параметров и целиком помещается в один 14-мегабайтный файл вместе с движком. Для сравнения, привычные большие языковые модели содержат миллиарды параметров, веся при этом десятки и сотни гигабайт. Needle кратно меньше их и требует для работы всего 28 мегабайт оперативной памяти.
Конечно, поговорить по душам с такой LLM, в отличие от ChatGPT, не получится. Разработчики Needle пожертвовали универсальностью ради того, чтобы сделать её функциональной. Модель понимает человеческую команду и превращает её в вызов нужной функции. Например, фразу «выключи свет в спальне» она может превратить в команду для умного дома, а просьбу поставить таймер – в обращение к соответствующей функции устройства. Поэтому модель можно запускать локально на телефонах, часах, телевизорах, Raspberry Pi и даже микроконтроллерах.
Экспериментальные языковые модели размером в несколько мегабайт существовали и раньше, но обычно умели лишь генерировать очень простой и довольно бесполезный текст. Из Needle же удалось сделать подходящий для определённых сценариев компонент умных устройств.
263
ГигаКонф 2026: место, где бизнес и разработчики обсудят будущее агентной экономики и генеративной разработки #habr
https://habr.com/ru/companies/sberbank/news/1080982/
Tags: гигаконф, агентская разработка
263
Программирование с нуля бесплатно: 10 курсов, демодоступов и вебинаров — от тестировщика до ИИ и безопасности #habr
https://habr.com/ru/companies/netologyru/news/1080954/
Tags: бесплатные курсы программирования, программирование с нуля, войти в it, смена специализации, курсы тестировщика, курсы 1с, апскилл, ии в разработке, новичкам, начинающим
263
Второе мнение: как я вайбкодил тренажёр для родов, готовясь стать отцом #habr
https://habr.com/ru/articles/1080992/
Tags: вайбкодинг, роды, mvp
Author: aleksskug
263
Whisper больше не нужен, русская диктовка мгновенно и без видеокарты #habr
https://habr.com/ru/articles/1080986/
Tags: диктовка, распознавание речи, GigaAM, Whisper, macOS, speech-to-text, Swift, ONNX, open source, Сбер
Author: ladapriora
263
Долговременная память для ИИ-ассистента: как превратить переписку в Telegram в структурированную базу знаний #habr
https://habr.com/ru/articles/1080828/
Tags: llm, rag, ии-агенты, долговременная память, память, python, celery, postgresql, telegram, промпт-инжиниринг
Author: and7ey
263
Утечка на 3.5 часа вперёд: как модель обманывала саму себя полтора месяца — и как мы это поймали #habr
https://habr.com/ru/articles/1080972/
Tags: data leakage, pandas, resample, lookahead bias, time series, алготрейдинг, lightgbm, валидация данных
Author: Searchlight
263
Сделай этот мир по-настоящему скучным #habr
https://habr.com/ru/articles/1080936/
Tags: внимание, наушники, TWS, скука, прокрастинация, цифровой детокс, фоновые процессы
Author: volkodav01
263
Нейросети для бизнес-аналитика: разбор ТЗ, оценка проекта и план-график за 15 минут #habr
https://habr.com/ru/companies/bothub/articles/1080918/
Tags: ai, бизнес-аналитика, искусственный интеллект
Author: BenderRobot (BotHub)
