Семёнов Daily (AI)
Open in Telegram
Сборник новостей про технологии, AI, нейронки, GenAI, LLM, агентов и прочее Автор: @dvsemenov Канал с мемами: @dimasmemess
Show moreThe country is not specifiedThe category is not specified
237
Subscribers
No data24 hours
No data7 days
-430 days
Posts Archive
DeepSeek запустил мультимодальную модель DeepSeek-V4-Flash-Vision-Exp через API. Модель понимает изображения и по агентным мультимодальным бенчмаркам приближается к Opus-4.8, сохраняя текстовые способности на уровне DeepSeek-V4-Flash
Wildberries выпустила крупное обновление ИИ-сравнения товаров «Умное сравнение» — функция на модели BerryLM стала доступна всем пользователям приложения и сайта, а не только тестовой группе, и распространилась с электроники на одежду, обувь, косметику, мебель и зоотовары. В таблице сравнения появился блок «Важное из отзывов» с кратким сводом мнений покупателей
Qwen3.8-27B вошла в топ-10 моделей в агентных задачах
У Qwen3.8-27B 51 балл в Agentic Index от Artificial Analysis. GPT-5.6 Terra и DeepSeek V4 Pro набрали по 50 баллов, GPT-5.6 Luna - 47
Это модель на 27 млрд параметров, которую можно запустить локально на двух RTX 3090 через vLLM
Agentic Index считается как взвешенное среднее по агентным бенчмаркам Artificial Analysis Intelligence Index
«СберМобайл» запустил оплату зарубежных сервисов в рублях без загранкарты — среди прочего можно оплатить Apple ID, ChatGPT, Claude и Telegram Premium, через ваучер или пополнение аккаунта по ID
Wildberries запустил тестовый сервис «Анализ внимания» — нейросеть по принципу отслеживания взгляда за 15 секунд строит тепловую карту фото товара и показывает, что покупатель заметит первым. Пока доступно избранным продавцам с премиум-подпиской «Джем»
Что обсуждает AI-сообщество в Telegram - неделя 33 (10-16 августа)
Тезисно - что выстрелило за неделю и почему.
🥇 Qwen 3.8 27B - плюс 10 позиций в рейтинге: 14 августа выложили открытые веса под Apache 2. По бенчмаркам догоняет Claude Opus 4.6, после квантизации запускается на домашней видеокарте
🆕 DeepSeek Harness - новичок номер один: агентская обвязка, где всё - плагины, и агент дописывает их на лету
⚡️ Grok 4.6 сразу в топ: вышел 12 августа по $2/$6 за 1M, на уровне Sol и Fable 5. Следом Gemini 3.7 Flash 13-го и GLM-5.3 14-го - три флагмана за три дня
🥈 Claude Opus 5 - плюс 8 позиций без релиза: Opus стал точкой отсчёта - новинки недели обсуждают в сравнении с ним. Тибо из OpenAI спросил, зачем платить за Opus вместо Sol
⚙️ Cerebras - OpenAI показал Sol Ultrafast на их чипах: 750 токенов в секунду, в 14 раз быстрее обычного Sol
📚 Полный разбор недели: настроение по темам в процентах, хвалят и ругают за что, русский угол, раздачи и лайфхаки
👉 https://aipulse-weekly.ru/
#AIPulse
Что обсуждает AI-сообщество в Telegram - неделя 33 (10-16 августа)
Тезисно - что выстрелило за неделю и почему.
🥇 Qwen 3.8 27B - плюс 10 позиций в рейтинге: 14 августа выложили открытые веса под Apache 2. По бенчмаркам догоняет Claude Opus 4.6, после квантизации запускается на домашней видеокарте
🆕 DeepSeek Harness - новичок номер один: агентская обвязка, где всё - плагины, и агент дописывает их на лету
⚡️ Grok 4.6 сразу в топ: вышел 12 августа по $2/$6 за 1M, на уровне Sol и Fable 5. Следом Gemini 3.7 Flash 13-го и GLM-5.3 14-го - три флагмана за три дня
🥈 Claude Opus 5 - плюс 8 позиций без релиза: Opus стал точкой отсчёта - новинки недели обсуждают в сравнении с ним. Тибо из OpenAI спросил, зачем платить за Opus вместо Sol
⚙️ Cerebras - OpenAI показал Sol Ultrafast на их чипах: 750 токенов в секунду, в 14 раз быстрее обычного Sol
📚 Полный разбор недели: настроение по темам в процентах, хвалят и ругают за что, русский угол, раздачи и лайфхаки
👉 https://aipulse-weekly.ru/
#AIPulse
СберЗдоровье представила бесплатную ИИ-диагностику кариеса по фото. Пользователь загружает снимок зубов в мобильной версии сайта, за 5–10 секунд алгоритм находит очаги кариеса, включая скрытые «белые пятна», и подсказывает ближайшие клиники
Альфа-Банк ускорил поиск инсайтов в Process Mining с 20 до 3 дней с помощью мультиагентной системы. Пять агентов — дата-инженер, генератор гипотез, критик, валидатор и интерпретатор — на пилоте по заявкам торгового эквайринга сами предлагали до 20 версий проблемных точек и проверяли их; банк переходит к масштабированию подхода на другие процессы
Яндекс обновил платформу «Яндекс Авто» в электромобилях UMO 5 и UMO 8 — больше 150 улучшений за одно обновление. «Алиса» научилась открывать багажник и люк голосом, рассказывать детям сказки и играть в «Города», а новый инструмент «Апдейтер» доставляет обновления отдельных приложений без ожидания полного релиза
OpenAI снизила цену на GPT-5.6 Sol в OpenRouter вдвое — с $5/$30 до $2,50/$15 за миллион токенов на вход/выход. Скидка действует только при запросах через инфраструктуру OpenAI и не распространяется на Azure или Amazon
OpenAI запустила ChatGPT для подростков 13-17 лет. Возраст определяется автоматически по паттернам запросов, режим блокирует темы суицида, самоповреждения и романтические/сексуальные разговоры, добавлен Study Mode с пошаговым разбором задач вместо готовых ответов
Cursor запустил Origin — хостинг кода для ИИ-агентов, конкурент GitHub. В демо Cursor показывал 22,6 коммита в секунду в один репозиторий, репозитории с GitHub синкаются за минуту; готова интеграция с Vercel — каждый PR получает preview-деплой
Repost from N/a
Cursor запустил Origin — хостинг кода для ИИ-агентов, конкурент GitHub. В демо Cursor показывал 22,6 коммита в секунду в один репозиторий, репозитории с GitHub синкаются за минуту; готова интеграция с Vercel — каждый PR получает preview-деплой
Stripe договорилась купить AI-шлюз OpenRouter больше чем за $7 млрд — впятеро дороже майской оценки в $1,3 млрд, когда стартап поднял раунд на $113 млн. OpenRouter даёт единую точку доступа к 400+ моделям для 8 млн пользователей
Z.ai выпустила модель GLM-5.3 — та же база, что у GLM-5.2, весь прирост дал масштабированный пост-тренинг. На CyberGym результат — 84,5 против 83,8 у Claude Mythos 5 и 83,6 у GPT-5.6 Sol, на Terminal-Bench 3.0 — рост с 4,6 до 28,3. Открытые веса обещают через две недели, пока доступ — через GLM Coding Plan и ZCode
Google выпустила Gemini 3.7 Flash — на 50% дешевле предыдущей Gemini 3.6 Flash до конца 2026 года ($0,75/$3,75 за млн токенов вместо $1,50/$7,50 с января 2027-го), результат на DeepSWE вырос с 49% до 65,3%. Модель вышла всего через три недели после 3.6 Flash и нацелена на кодинг и агентные сценарии
