es
Feedback
Код в мешке

Код в мешке

Ir al canal en Telegram

Код в мешке - про кодинг, и не только... Это личная записная книжка https://t.me/joinchat/AAAAAEIy6oGlr8oxqTMS5w

Mostrar más
264
Suscriptores
Sin datos24 horas
+37 días
+1030 días
Archivo de publicaciones
CUDA готова пустить к себе RISC-V, если платформа дорастёт до серверной Процессор, который раздаёт видеокарте работу в CUDA,
CUDA готова пустить к себе RISC-V, если платформа дорастёт до серверной Процессор, который раздаёт видеокарте работу в CUDA, может быть только x86-64 или aarch64. На Hot Chips 2026 Nvidia назвала условия, при которых к ним добавится RISC-V. Требования серверные: профиль RVA23, спецификации RISC-V для серверного SoC и платформы, поддержка ACPI, через которую система узнаёт у железа, что оно умеет, и когерентность PCIe. Последний пункт объясняет, почему дешёвой платформой не отделаться. Без когерентности процессор записал данные, а они ещё лежат в его кэше; копирование в память видеокарты идёт мимо процессора, прямо из DRAM, и утаскивает устаревшую версию. Спасают только ручные сбросы кэшей на каждой передаче. Чего Nvidia хочет от векторных расширений, разбирают в Chips and Cheese.

Есть один разработчик, который искренне верит, что отпуск случится сразу после релиза. Проблема в том, что релизы у него не з
Есть один разработчик, который искренне верит, что отпуск случится сразу после релиза. Проблема в том, что релизы у него не заканчиваются никогда. 😅 Сам он с места не сдвинется, поэтому нужна ваша помощь. В новой мини-игре вам предстоит разгрести бардак, найти билет, собрать чемодан и приодеть программиста для отпуска. Заодно собирайте промо-коды от партнёров! Играть

Разработчик собрал фоторедактор, который ни разу не отправляет фото на сервер Любая онлайновая удалялка фона работает одинако
Разработчик собрал фоторедактор, который ни разу не отправляет фото на сервер Любая онлайновая удалялка фона работает одинаково: вы загружаете снимок, модель крутится на чужой машине, вы забираете результат. Копия уже ушла, и что с ней дальше, вам не расскажут. В APIC-Web фон, объекты, фильтры, конвертация и сжатие живут прямо в браузере, на Canvas, WebAssembly и локальной модели. Вырезать фон просто, пока в кадре нет волос. Очевидный путь через ImageSegmenter из MediaPipe с флагом outputCategoryMask отдаёт на пиксель жёсткий ноль или единицу. По волосам получается лесенка, и размытием её не спасти: промежуточные значения округлились и потерялись. Приём в том, чтобы забрать вероятности до округления. Флаг outputConfidenceMasks отдаёт на пиксель число от нуля до единицы, и дальше край собирается в несколько шагов. Модель та же, край другой. Грабли: число каналов уверенности у моделей разное, так что проверяйте длину массива вместо confidenceMasks[1]. Оба сложных куска редактора расписаны с кодом.

Repost from IT Юмор
Кто уже потестил Басню 5.1?
Кто уже потестил Басню 5.1?

📙 Cactus Needle 2 — 14 МБ агентная LLM для устройств без GPU
Обзор Needle 2 от Cactus Compute: открытая модель на 45М параметров и 14 МБ для вызова функций на устройствах умного дома, роботах и носимой электронике.
↘️ Needle 2 - The 14 MB Agentic LLM for Tiny Devices | Cactus Today we release Needle 2: an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs in 28MB of RAM. It is built on our Simple Attention Network, compressed to CQ2-bit with Cactus Quants, and baked into its own engine. Cactus-Compute/needle2 · Hugging Face Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs a full session in 28MB of RAM. It is built on our Simple Attention Network findings, compressed ... GitHub - cactus-compute/needle: 14MB foundation model for tiny devices; phones, wearables, smart home, and robots Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs a full session in about 28MB of RAM. needle/README.md at main · cactus-compute/needle Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs a full session in about 28MB of RAM.

needle/README.md at main · cactus-compute/needle Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs a full session in about 28MB of RAM.

Cactus Needle 2 — 14 МБ агентная LLM для устройств без GPU ... Aug 11, 2026 · Обзор Needle 2 от Cactus Compute: открытая модель на 45М параметров и 14 МБ для вызова функций на устройствах умного дома, роботах и носимой электронике. Архитектура, квантование и результаты бенчмарков.

GitHub - cactus-compute/needle: 14MB foundation model for tiny devices; phones, wearables, smart home, and robots. · GitHub 2 days ago - Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs a full session in about 28MB of RAM.

Cactus-Compute/needle2 · Hugging Face 1 month ago - Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs a full session in 28MB of RAM. It is built on our Simple Attention Network findings, compressed ...

Needle 2 - The 14 MB Agentic LLM for Tiny Devices | Cactus Today we release Needle 2: an open 45M-parameter model for tool calling, device use and structured extraction. The whole model is a single 14MB binary that runs in 28MB of RAM. It is built on our Simple Attention Network, compressed to CQ2-bit with Cactus Quants, and baked into its own engine.

Repost from Content-Review.com
Цифра дня Всего 14 мегабайт весит языковая модель, которая может управлять устройством. Needle 2 от стартапа Cactus состоит и
Цифра дня Всего 14 мегабайт весит языковая модель, которая может управлять устройством. Needle 2 от стартапа Cactus состоит из 45 миллионов параметров и целиком помещается в один 14-мегабайтный файл вместе с движком. Для сравнения, привычные большие языковые модели содержат миллиарды параметров, веся при этом десятки и сотни гигабайт. Needle кратно меньше их и требует для работы всего 28 мегабайт оперативной памяти. Конечно, поговорить по душам с такой LLM, в отличие от ChatGPT, не получится. Разработчики Needle пожертвовали универсальностью ради того, чтобы сделать её функциональной. Модель понимает человеческую команду и превращает её в вызов нужной функции. Например, фразу «выключи свет в спальне» она может превратить в команду для умного дома, а просьбу поставить таймер – в обращение к соответствующей функции устройства. Поэтому модель можно запускать локально на телефонах, часах, телевизорах, Raspberry Pi и даже микроконтроллерах. Экспериментальные языковые модели размером в несколько мегабайт существовали и раньше, но обычно умели лишь генерировать очень простой и довольно бесполезный текст. Из Needle же удалось сделать подходящий для определённых сценариев компонент умных устройств.

ГигаКонф 2026: место, где бизнес и разработчики обсудят будущее агентной экономики и генеративной разработки #habr https://habr.com/ru/companies/sberbank/news/1080982/ Tags: гигаконф, агентская разработка

Программирование с нуля бесплатно: 10 курсов, демодоступов и вебинаров — от тестировщика до ИИ и безопасности #habr https://habr.com/ru/companies/netologyru/news/1080954/ Tags: бесплатные курсы программирования, программирование с нуля, войти в it, смена специализации, курсы тестировщика, курсы 1с, апскилл, ии в разработке, новичкам, начинающим

Второе мнение: как я вайбкодил тренажёр для родов, готовясь стать отцом #habr https://habr.com/ru/articles/1080992/ Tags: вайбкодинг, роды, mvp Author: aleksskug

Whisper больше не нужен, русская диктовка мгновенно и без видеокарты #habr https://habr.com/ru/articles/1080986/ Tags: диктовка, распознавание речи, GigaAM, Whisper, macOS, speech-to-text, Swift, ONNX, open source, Сбер Author: ladapriora

Долговременная память для ИИ-ассистента: как превратить переписку в Telegram в структурированную базу знаний #habr https://habr.com/ru/articles/1080828/ Tags: llm, rag, ии-агенты, долговременная память, память, python, celery, postgresql, telegram, промпт-инжиниринг Author: and7ey

Утечка на 3.5 часа вперёд: как модель обманывала саму себя полтора месяца — и как мы это поймали #habr https://habr.com/ru/articles/1080972/ Tags: data leakage, pandas, resample, lookahead bias, time series, алготрейдинг, lightgbm, валидация данных Author: Searchlight

Сделай этот мир по-настоящему скучным #habr https://habr.com/ru/articles/1080936/ Tags: внимание, наушники, TWS, скука, прокрастинация, цифровой детокс, фоновые процессы Author: volkodav01

Нейросети для бизнес-аналитика: разбор ТЗ, оценка проекта и план-график за 15 минут #habr https://habr.com/ru/companies/bothub/articles/1080918/ Tags: ai, бизнес-аналитика, искусственный интеллект Author: BenderRobot (BotHub)