fa
Feedback
AINews | Нейросети

AINews | Нейросети

رفتن به کانال در Telegram

Это не новости, это персональный экспертный взгляд на то, как развивается индустрия ИИ, графики, метаверса, крипты, нейротехнологий и в каком направлении катится все это безобразие.

نمایش بیشتر
1 772
مشترکین
اطلاعاتی وجود ندارد24 ساعت
-107 روز
-2130 روز
آرشیو پست ها
Китайский путь ИИ. Зацепился глазом за новость. В развитии искусственного интеллекта /ИИ/ Сбербанк во многом ориентируется на опыт Китая. Об этом в интервью агенству Синьхуа рассказал первый заместитель председателя правления Сбербанка Александр Ведяхин. https://russian.news.cn/20241219/dde8a5b56ed8457aa461a125174dc044/c.html Ведяхин отметил, что в развитии технологий искусственного интеллекта Китай демонстрирует гибридный подход, при котором сочетается сильное саморегулирование и точечное нормативное регулирование, что позволяет индустрии развиваться. Судя по тому, какие видео модели выпускают китайцы (особенно в опен-сорс), там, по-моему, никакого регулирования вообще нет. Это, собственно и приводит к огромному прогрессу и к тому, что их видеогенераторы лучшие. Вопрос о регуляции ИИ меня вообще приводит в ярость. Но это отдельная от Китая тема.

Самурай для Нюка Ну наконец-то годные нейроинструменты из недр Гитхаба вкручивают в софты для взрослых. Samurai for Nuke allows you to generate masks from an image sequence, based on SAMURAI adaptation of SAM2 Model for Zero-Shot Visual Tracking with Motion-Aware Memory. Доп фичи: Mask export EXR input/output Frame range Bounding Box Interface Похоже, что только для Линукса. Интересно, сколько тут взрослых мальчиков с Нюком под Линуксом... https://github.com/Theo-SAMINADIN-td/NukeSamurai

Метаверсищще и ИИще Следующая новость отлично соответствует названию канала. Ибо это симуляция и визуализация физического мир
+9
Метаверсищще и ИИще Следующая новость отлично соответствует названию канала. Ибо это симуляция и визуализация физического мира на стероидах ИИ. 20+ лабораторий совместными усилиями разработали и выпустили исходный код Genesis - физического движка с Visual Language Model агентом, который превращает промпты в интерактивные 4D-миры. 4D - это новое модное слово, обозначающее 3D с анимацией. Для нас это просто 3Д-сцена, в которой что-то происходит - симуляция физики, движение камеры, анимация персонажа. Genesis - это как бы Maya или Houdini только на естественном языке, с ИИ-солверами, ускоренными примерно в 100-1000 раз, по сравнению с обычными солверами физики и кинематики. Это если очень грубо. Плюс рендеринг с рейтрейсингом. Под капотом используется агент на основе VLM, который использует симуляционные API в качестве инструментов, генерируя физически точное окружение, траектории движения камеры, поведение роботов и анимацию персонажей. Огромное количество физических SOTA-солверов + тонна материалов...

Если скормить ИИ новостные телеграм-каналы про ИИ. И попросить суммаризировать.
Если скормить ИИ новостные телеграм-каналы про ИИ. И попросить суммаризировать.

Бесплатным юзерам Suno завезли версию 4. В количестве 10 песен. В день.
Бесплатным юзерам Suno завезли версию 4. В количестве 10 песен. В день.

10-й стрим OpenAI Пока мы ждем (ждем жеж?) новостей про DALL·E 4, OpenAI исполняют в чудеса продуктологии. На сегодняшнем стр
10-й стрим OpenAI Пока мы ждем (ждем жеж?) новостей про DALL·E 4, OpenAI исполняют в чудеса продуктологии. На сегодняшнем стриме показали, что если вы позвоните (со штатовского номера) на +1-800-2428478, то попадете в головой режим chatGPT. Те, кто уже разучился звонить с телефона, могут писать в WhatsApp, а ответы получать либо голосом, либо текстом. Телеграм боты нервно закуривают овальные сигареты... Небольшая деталь: OpenAI is offering 15 minutes of free calling for U.S. users. The company notes that standard carrier fees may apply. А теперь про то, что не пишут: Как и в случае с ChatGPT по телефону, для общения в WhatsApp вам не нужен аккаунт, но существует суточный лимит. Пользователи получат уведомление о приближении к этому лимиту, и тогда они смогут продолжить общение, загрузив приложение ChatGPT или используя ChatGPT на настольном компьютере.

С приходом генеративного ИИ интернетик стремительно распухает. И вот мы уже видим вполне себе прозаичный сценарий: один пользователь просить chatGPT написать за него красивое письмо или отчет. А второй (получатель) просит chatGPT сократить и суммаризировать всю эту красивую велеречивую бизнес-графоманию. Ну или смышленые влоггеры генерят все эти ИИ-подкасты, а бедные слушатели просят ИИ дать им выжимку. У меня ощущение, что скоро мы будем ходить в интернет через компрессионные адаптеры. Ставишь расширение для Хрома, и оно тебе показывает уже пожатый, суммаризированный и просушенный интернетик. Стартаперы, забирайте идею. Латентный интернет - передаем вместо текстов, картинок и видео только эмбединги. А на клиенте генерим контент любой степени пожатости. Просто я натолкнулся на еще один ИИ-сервис, который делает из длинных видео короткие. За тридцать долларов в месяц. Create TikToks, Reels, Shorts from your long videos in just one click. Когда-то в прошлом веке у развитых экономик была задача - накорми...

🤖 ИИ и iGaming — в чем связь? AI трансформирует индустрию, и знание его возможностей — ключ к успеху. ➡️ Поэтому тебе нужно
🤖 ИИ и iGaming — в чем связь? AI трансформирует индустрию, и знание его возможностей — ключ к успеху. ➡️ Поэтому тебе нужно подписаться на Owner 1win! На канале ты найдешь: ⏺Анализ трендов — как AI меняет правила игры в индустрии азартных игр; ⏺Инсайты от экспертов — мнения лидеров рынка о будущем iGaming с использованием ИИ; ⏺Новые подходы к монетизации и привлечению игроков. 😍 Присоединяйся к Owner 1win и будь первым! #промо

Minimax / Music-01 Генератор музыки от Минимакса появился на Replicate. https://replicate.com/minimax/music-01 Если у вас там есть кредиты или бонусы, можете погенерить музики от Минимакса. Генерит треки до 1 минуты: - use reference songs, vocals and instrumental tracks - optional lyrics - reuse references for faster generations and consistency Как по мне, жосковато. До зная китайский прогресс, Суно стоит начинать нервничать. Апи документация тут

Jetson Orin Nano Super Все молчат вот про такой буквально новоиспеченный девайс от Нвидия. https://www.nvidia.com/en-us/auton
+4
Jetson Orin Nano Super Все молчат вот про такой буквально новоиспеченный девайс от Нвидия. https://www.nvidia.com/en-us/autonomous-machines/embedded-systems/jetson-orin/nano-super-developer-kit/ AI Performance 67 INT8 TOPS GPU NVIDIA Ampere architecture with 1024 CUDA cores and 32 tensor cores CPU 6-core Arm® Cortex®-A78AE v8.2 64-bit CPU 1.5MB L2 + 4MB L3 Memory 8GB 128-bit LPDDR5 102 GB/s Storage Supports SD card slot and external NVMe Power 7W–25W Внимание - 249 долларов за такую малышку. Теперь пара моментов. 8 гигабайт памяти. В маркетинговых сообщениях значится такое - теперь вы можете запускать свои LLM на таких вот оконечных устройствах. Да, наверное 3B, 7B и даже 9B модели могут влезть в память. И Stable Diffusion тоже прекрасно поместится и даже SDXL. Но надо понимать, что это не видеопамять, это shared memory (примерно как с новых маках). То есть в 8 гиг должны поместиться и модель, и операционка, и софт для запуска. Далее, CPU - 6-core Arm® Cortex®-A78AE. Вопрос с операционной си...

+5
Kling 1.6 Ну а чтобы Гугл не расслаблялся, вот вам немного утечек из будущего апдейта Kling до версии 1.6. Промпты забирайте тут.

+7
Ну, за Сора. Не чокаясь Вы извините, но у нас снова про видеогенераторы. В твиттор хлынули тесты Veo2 - генератора видео от Гугла. По крайней мере, это уже не черрипики с сайта и можно оценить реальное качество. И оно, похоже, очень и очень неплохое. Поглядите только на сцены из Прибытия, пересобранные с Veo. Но есть один маленький момент. Гугл, как обычно, очень перестраховывается с цензурой. Поэтому вместо Image2video у них text2image2video - вы не можете подсунуть свои картинки на вход, вы можете их только сгенерить в самом генераторе и уже из них он сделает видео. Это позволяет отсечь всякие глупости, которые вы будете пихать в него.

Что показали сегодня, анонсы в основном для разработчиков: - O1 модели теперь поддерживают строгие JSON схемы на выходе (и это не повлияет на качество работы модели) и Functions calling (это когда модель должна выбрать какой-то скрипт сама по себе во время ответа), фичи которые давно есть у других моделей OpenAI - Упомянули «Developers Messages» для O1 — штука, которая позволяет разработчиком «направить» модель в нужную сторону в процессе ответа, что-то вроде второго системного промпта, но слабее - «Reasoning Effort» — вы теперь можете указать сколько времени O1-модель будет «размышлять» перед тем как ответить, ответы будут лучше, но дороже или можно запретить ей слишком много думать перед ответом пользователю - O1 API теперь поддерживает картинки на вход - Advanced Voice Mode API теперь работает с WebRTC, то есть голосового ассистента OpenAI будет проще встраивать на веб-страницы без особых мучений (12 строк кода и готово) - Наконец-то цены на Advanced Voice Mode API понизили на 60%, и теперь доступна новая, в 10 раз дешевле, mini-аудио моделька - Показали новый способ файнтюна моделей «Prefence Finetuning» — можно тренировать на парах данных, что нравится и не нравится в ответе модели, доступно с сегодня для gpt4o & gpt4o-mini - Вышли новые SDK — для Go и для Java Если честно затянуто немного со всеми этими днями, я бы списком почитал уже, еще 3 дня осталось

Руй видео. Вы будете смеяцца, но у нас новая опенсорсная видео модель. Причем image2video. Ruyi is an image-to-video model capable of generating cinematic-quality videos at a resolution of 768, with a frame rate of 24 frames per second, totaling 5 seconds and 120 frames. It supports lens control and motion amplitude control. Using a RTX 3090 or RTX 4090, you can generate 512 resolution, 120 frames (or 768 resolution, ~72 frames) videos without any loss of quality. https://github.com/IamCreateAI/Ruyi-Models Поддержка видеогенерации в Комфи из коробки. , что будем делать? Когда все это успеть протестировать? И очень толково оформленный GitHub:

Mocha 2025 - Object Brush В новую версию Mocha завезли нейроротоскоп. Если это в реальности работает хорошо как на видео (сомневаюсь), то глядишь, всякие громоздкие костыли станут не нужны #roto #video2mask

+8
Мятное видео. Вы будете смеяться, но у нас новый видео-генератор! Причем не простой! А с ништяками. MinT is the first text-to-video model capable of generating sequential events and controlling their timestamps. Во-первых, это Снап. Там в авторах Сергей Туляков и Александр Сярохин. Хотя я так понимаю, это работа интерна Ziyi Wu. Во-вторых, там интересная фишка, работа со временем, промптовый монтаж. Только не прямыми склейками, а латентными. Видео просто генерится с последнего кадра, сохраняя ВСЮ консистентность предыдущего видео. Это вам не image2video склейки. Проще показать промпт: [0.0s → 2.3s]: A young man typing on the laptop keyboard with both hands. [2.3s → 4.5s]: The man touches the headphones with his right hand. [4.5s → 6.5s]: The man closes the laptop with his left hand. [6.5s → 9.1s]: The man stands up. И все это в одном сеттинге. Выглядит очень нарядно, всегда симпатизировал разработкам Снапа. Обязательно посмотрите примеры тут: https://mint-video.github.io/ Там интересно. По пово...

Оппа, оказывается у Клинга тоже можно управлять временем: [0.0s → 1.5s]: The woman tilts her head side to side, smiling at the camera. [1.5s → 3.5s]: She waves hello with her right hand, still smiling. [3.5s → 5s]: She rests both hands under her chin, tilting her head side to side with a smile.

Оригинал, а не копия MTС провел конференцию MTS StartUp Day. Мероприятие стало настоящим парадом главных инвестиционных трендов российского рынка. По мнению спикеров, 2024 год стал периодом венчурной зимы — много проектов заморозились в связи с низкой активностью фондов. Но в 2025 году сулят оттепель. Уже растет количество новых сделок M&A и увеличивается интерес к pre-IPO. Инвесторы не обошли стороной три главных слова — что с ИИ? В отличие от B2B и энергетики, сегмент до сих пор ощущается рынком как пузырь. Поэтому вопрос, откуда брать деньги на развитие генеративных технологий, остается открытым. Главным тезисом дискуссии стал вывод, что рынку необходимо стремиться к созданию новых оригинальных продуктов, а не пытаться повторить успех существующих аналогов. Алексей Басов, BSF Partners, подчеркнул: «Наша программа подготовки к pre-IPO с МИК уже завершила первый выпуск 40 будущих эмитентов, из которых 80% вероятно будут куплены в полете, не добравшись до публичных рынков». А Дмитрий Курин добавил: «У нас законтрактовано больше 10 качественных компаний», демонстрируя наличие значительного числа готовящихся сделок, как публичных, так и частных. Что ж, такому настрою можно только позавидовать. Посмотрим, что готовит нам рынок в следующем году.

Кто круче? Конечно, сравнивать видеогенераторы на одном промпте затея не очень корректная. Но пользователю-то все равно, что один генератор любит детальные промпты, а второй отлично раскучерявливает под капотом короткие в супердлинные. Пользователь хочет удобства, фич и результата. Промпт здесь, конечно, жоский: Руки, физика, отношение между объектами, движение самой нарезки, интерпретация "стейк сделан идеально", пар, сок и т.д. Prompt: A pair of hands skillfully slicing a perfectly cooked steak on a wooden cutting board. faint steam rising from it. Пика и Люма сразу обозначили, что они про другое. Ранвей удивил в плохом смысле. Клинг и Минимакс удержались в рамках задачи, а Клинг вообще накреативил, как он умеет. Гугловая генерация выглядит топово, но сдается мне это лютый черрипик. Но самое крутое, что опенсорсный Хуньянь составил конкуренцию всем остальным и действительно уделал Рунвей.

Коротенечко про Android XR и Google Glasses Десять лет назад Гугл выпустил google glasses и они были прекрасны. Но не взлетел
Коротенечко про Android XR и Google Glasses Десять лет назад Гугл выпустил google glasses и они были прекрасны. Но не взлетели. Сейчас они заходят в эту реку второй раз. Очки снова анонсировали на недавней конфе для разрабов Гугла вместе с анонсом Google: Android XR. https://www.wired.com/story/google-android-xr-demo-smart-glasses-mixed-reality-headset-project-moohan/ Кстати, это уже пятая операционка от Гугла для мобильных утройств после Android, Wear OS, Google TV и Android Auto. Хромбуки не в счет. Но им приходится снова быть (по традиции) в роли догоняющего. Метачка уже вовсю обновляет существующие очки (теперь там есть ИИ-ассистент, переводчик и даже Шазам!), а у Гугла, как обычно, "когда-то в будущем". https://www.theverge.com/2024/12/16/24322628/ray-ban-meta-smart-glasses-live-ai-translation-shazam Интересно, что они объединились с Самсунгом и Квалкомом. А Самсунг даже показал ответочку Мета Квесту и Лыжной Маске - проект Мухан. Но тоже без сроков выхода и с невнятным позиционированием. http...