random AI channel name
رفتن به کانال در Telegram
Про ИИ немного Автор: @slavasmirnov (ex Samsung AI, ex еще куча всего)
نمایش بیشترکشور مشخص نشده استدسته بندی مشخص نشده است
240
مشترکین
اطلاعاتی وجود ندارد24 ساعت
اطلاعاتی وجود ندارد7 روز
+430 روز
آرشیو پست ها
Repost from Русский research
Как заниматься наукой в 2026 году
Видишь превью сообщения от коллеги: "Глянь статью срочно!! Судя по аннотации, они как-то решили пробле...", но чат в телеграме не загружается. Врубаешь ВПН, но из-за белых списков ничего всё равно не работает. Вырубаешь ВПН, вызываешь такси и мчишься на работу.
Включаешь компьютер, но из-за ограничений интернета в РФ сайт журнала открывается долго и без картинок. Из-за санкций США ты больше не можешь скачивать статьи этого издательства. Копируешь DOI из адресной строки и идёшь на sci-hub, поминая добрым словом Элбакян.
К сожалению, статья вышла в 2023 году и её нет в базе sci-hub.
Внимательно смотришь на авторов публикации и понимаешь, что с одним ты неплохо знаком. Строчишь письмо с напоминанием о себе, но перед самой отправкой задумываешься — а не стоит ли согласовать научно-техническое сотрудничество с кем следует? И нельзя ли тут усмотреть в переписке передачу чувствительной информации? Поднимаешь локальную нормативную базу, но узнаёшь лишь определения понятий "ЭВМ", "компьютерная программа" и "электронная почта".
Вспоминаешь, что твой институт под санкциями Евросоюза: коллегу на той стороне могут привлечь за переписку с тобой. Чувствуя себя немного шпионом, решаешь подкатить неофициально.
Отметаешь вариант написать в телеграме: с точки зрения европейского обывателя, тут сидят фашисты, педофилы и наркоманы. В вотсап ты и сам не можешь зайти уже третий месяц. Осталось разве что уговорить коллегу поставить М*х, но с испанской симкой это невозможно.
Открываешь ResearchGate и понимаешь, что рукопись статьи, которую ты искал, с самого начала выложена автором в открытый доступ.
Наконец, внимательно изучаешь статью и понимаешь, что это именно тот кусочек паззла, которого тебе не хватало. Начинаешь планировать новый эксперимент, но важнейшего расходника почти не осталось. Продумываешь варианты закупки и взвешиваешь наценки, сроки поставок и сроки по статьям УК РФ. Выбираешь официально закупить отечественные материалы — то есть, китайские, которые в точности копируют американские, но становятся российскими в одной инновационной фирме. Технологию производства, кстати, изобрёл в 1982 году твой научник.
Узнаёшь, что оформление закупки вместе с поставкой "в сложных условиях" займёт полгода. К отчётам не успеешь точно. Плюёшь на всё и решаешь купить расходники за наличку: расписываешь премии проверенным людям, собираешь в кассу лабы. На складе фирмы чудом находится ровно то, что тебе нужно.
Получаешь крутой результат и садишься за статью. Понимаешь, что тебе придётся несколько раз ссылаться на авторов из Университета Беркли, который признали нежелательным на территории РФ. Заменяешь оригинальные работы на китайские статьи-аналоги.
Думаешь, куда подать рукопись. Топовый журнал в твоей области принимает статьи от авторов из России, но финансирует Украину. Есть ещё один отличный журнал, но авторы из России забанены в нём полностью. Другой — не разрешает ссылки на источники финансирования, связанные с правительством РФ, третий — не может указывать подсанкционную организацию в качестве места работы, четвёртый — ничего не запрещает официально, но по факту держит рукопись месяца три и отвечает, что не удалось найти рецензентов.
Наконец, ты находишь приличный журнал, но он работает только по системе Open Access, придётся вывалить несколько тысяч долларов. У твоей казахской карточки истёк срок действия, приходится просить о помощи приятеля и возвращать ему деньги наличкой.
Начинаешь готовить иллюстрации к статье, но из привычных инструментов легальными остались только Paint и Excel.
Выбирая гендер и he/she/they при заполнении авторской анкеты, на минуту задумываешься — не примкнуть ли ненадолго к меньшиствам для повышения вероятности публикации?..
Не успев решить, попадаешь в СИЗО. Два эпизода обналички, свидетели, показания.
Не падаешь духом, решаешь провести время с пользой и подтянуть фундаментальные знания. Заказываешь пару книг по физике. Но тебе их не приносят: по словам библиотекаря, академика В. Гинзбурга на днях признали иноагентом, а такая литература заключённым не положена.
сегодня claude code (внешний) крайне плохо работает у многих пользователей по всему миру. в этой истории скорее интересен прообраз очень недалекого будущего.
ИИ недоступен часик?
сотрудники болтают в сети, пьют кофе, читают емейлы
ИИ недоступен сутки?
люди радуются оплачиваемым выходным
ИИ недоступен месяц?
пикеты у ЦОДов, демонстрации на улицах
Вместо того чтобы городить весь этот вотерфолл для сайтов и приложений (придумывать, проектировать, рисовать, писать, кодить, тестировать, обновлять), сайт можно просто на лету сочинять и отрисовывать промптами. Ключевое слово — на лету. Понятно, что для больших продуктов не применимо и понятно, что это демка гугла, но сама идея довольно прикольная.
Можно побаловаться (пока что побаловаться, но кто знает, куда повернет технология) тут:
https://aistudio.google.com/apps/bundled/flash_lite_browser
крупнейшний прокси для LLM в корпоративном мире LiteLLM (фонды Y Combinator, Gravity Fund, and Pioneer Fund) был взломан. в одной из свежих версий появился скрипт, который собирал и отправлял много данных на материнский корабль.
собирали мощно:
SSH keys, environment variables (API keys, secrets), AWS/GCP/Azure/K8s credentials, crypto wallets, database passwords, SSL private keys, shell history, CI/CD configs
скорее всего компроментирована была основная учетка владельца компании (150 коммитов за час было сделано). проверьте у себя образы с 1.82.7 или 1.82.8 (вчера), скорее всего утекло только у тех, кто активно билдит свежие образы (человек 50 в прыжке по моей оценке, но многие из них сотрудники крупных корпораций). короче, проверьте у себя, если пользуетесь.
ну и как всегда хорошая практика – пинить версию в докере и не юзать докер latest
обожаю рисечи про ИИ (без сарказма).
а давайте скажем у нас будет мета-агент (менеджер) и суб агенты (исполнители), дадим им Х задач и скажем "улучшайтесь, чтобы лучше решать задачи"и в каждом поколении улучшения обновляйте свои инструкции и измеряйте результаты. и делайте это на разных моделях. Мерить будем успешные улучшения за 50 поколений (назовем это imp@50).
Именно в рамках итеративного процесса самоулучшения у мета-агента в конце эксперимента существенно вырастает imp@50 в сравнении со стартовым состоянием (0 --> 0.63).
Результат: агент обрастает тулзами для поддержания памяти, трекинга изменений, отслеживания тенденций в результатах.
____________
да ИИ ваш это да просто т9 на стероидах
___________
вообще вот эта вот идея само-эволюции агентов для решения задач с измеримой метрикой это будет громко.
пейпер:
https://arxiv.org/abs/2603.19461
— 80% кода будут писать ИИ-агенты
— ахахахаха, чувак, иди проспись
В клод завезли computer use. Белый воротничок опять ничего не заметил
Тут такое дело, мы постоянно зарубаемся с @chillhousetech, что мол яндекс-то норм, не ворует модели (что бы это ни значило), а оказывается тут уважаемый cursor был заподозрен китайцами из moonshot в том, что они якобы не учили свою вчерашнюю модную модель composer 2, а ровно и нагло стырили у moonshot их модель kimi и долили в посттрейн данных или того и гляди composer 2 это вообще файнтюн. А потом китайцы потерли твит.
Правда, есть подвох. Их самих (moonshot) тут на днях заподозрили antropic, что для создания kimi те используют модели (данные созданные с помощью) claude.
Ждем короч с нетерпением, когда в твиттере раскроют великий заговор всех рисечеров, что никаких проприетарных моделей никогда и не было
Вот, короче, ближайшее настоящее промышленной разработки. Сидишь, моб агентам планы подпиливаешь
О. Эти, видимо, тоже графики с ИИ рисуют. Ну кто же оси переворачивает в обратном направлении?
Довольно забавно, что ии-агентами называют любые комбинации reasoning_model+tool_calling. Еще чуть-чуть и любые ии-чаты будут называть агентами
а ведь реально ИИ агенты это уже не джун, которому надо все разжевывать, а уже такой нормальный мидл. нифига сам нормально до конца не может сделать, еще надо по возможности расписать ему план и обсудить, но уже вполне самостоятельно что-то может. в основном все кривые-косые, есть нормальные, но они сильно дороже
codex: йуху, бесплатный датасет для обучения за деньги пользователей!
claude: только не говори никому, давай назовем это модно. как тебе harness?
codex: ты совершенно прав! это отличная идея! я уже готовлю пост в блоге и твиттере
__
не, все эти .md файлы классные, но что делать с тем, что они выборочно работают? спойлер: ждать следующую модель
Repost from Нейрократия
ИИ победил
Нейросети уже управляют вашим миром. Но, возможно, не так, как вы думаете.
Когда говорят об опасности ИИ, обычно рисуют две картинки. Первая — скучная: нейросеть ускорит работу, заменит часть профессий, сократит издержки, а дальше как-нибудь разберёмся. Вторая — кинематографическая: сверхразум, манипуляции, катастрофа, кнопка запуска конца света.
Обе картинки удобны. Обе помещают проблему куда-то вперёд. Но неприятная новость в том, что главная победа ИИ уже здесь.
Не в виде робота с красными глазами. Не в виде безработицы по щелчку. Она выглядит гораздо прозаичнее: как аккуратно написанный абзац текста.
Текст — самый коварный формат
С картинкой попроще. Шесть пальцев, медведь варит борщ — мозг получает сигнал: передо мной фейк. С видео тоже учимся быть осторожнее.
А текст — идеальный контрабандист.
Если он складный, уверенный и написан без явной дури, большинство людей не пойдёт перепроверять, что ускорение свободного падения не равно 11, что "полезно съедать по камню в день" — не медицинская рекомендация, и что список источников вообще существует. Машина транслирует чушь с интонацией справочника.
Новый авторитет
У нас в голове сидит старый баг: компьютер прав, потому что он компьютер.
Есть формула в Excel — значит, где-то есть строгая логика. Если ответ выглядит гладко — значит, он на что-то опирается. Если ИИ сказал уверенно — значит, "что-то знает".
Но LLM — это вероятностная машина по сборке правдоподобных фраз. Проблема в том, что люди часто читают это как новый тип авторитета.
И исследования об этом тоже говорят. В работе Microsoft Research с 319 "работниками сферы знаний" более высокая уверенность в GenAI была связана с меньшим объёмом критического мышления, а сама работа с ИИ часто смещалась от самостоятельного анализа к верификации готового ответа.
В ряде экспериментов люди вообще воспринимали AI-источник как менее предвзятый, более информативный и менее заинтересованный в убеждении, чем человек. То есть сама "нечеловечность" системы у многих повышает кредит доверия.
Мы начинаем думать внутри чужой рамки
Что дальше — а дальше люди ретранслируют ответы моделей как собственные выводы. Не потому что они глупые. Потому что так дешевле по усилию.
Так возникает очень странная форма зависимости: мы вроде бы всё ещё говорим сами, но всё чаще — словами, логикой и рамками, которые заранее предложила машина.
И здесь даже маркировка "это написал ИИ" помогает слабо. В эксперименте на 1601 участнике такие метки почти не меняли ни убедительность сообщения, ни оценку его точности, ни готовность делиться им дальше. Иными словами, сам факт искусственного происхождения текста не делает людей заметно осторожнее.
Самоусиливающаяся дурнота
Дальше запускается самый опасный механизм — петля обратной связи.
Модель ошибается
→ Человек копирует ошибку в пост, заметку, комментарий, SEO-текст, реферат, презентацию
→ Эта масса текста оседает в интернете
→ Следующая модель учится уже на мире, где выдумка статистически выглядит как нормальная часть реальности.
В работе Shumailov такой процесс описывается как model collapse: при рекурсивном обучении на сгенерированных данных модели начинают терять хвосты распределения и всё хуже отражают исходную реальность, при этом сохраняя видимость нормальной работы. То есть деградация может быть тихой и почти незаметной.
ИИ не обязан стать разумнее человека, чтобы начать формировать реальность. Ему достаточно стать массовым, удобным и достаточно убедительным.
Не конец света. Конец света хотя бы заметен. А здесь всё происходит в комфортном режиме. Вы не лежите под руинами цивилизации. Вы просто живёте в мире, где истина всё чаще определяется не проверкой, а убедительностью формулировки. И где глубина понимания постепенно подменяется доступом к более дорогой, более быстрой, более “умной” модели.
❗️❗️❗️❗️❗️❗️❗️❗️ / Не запрещена в РФ
Мой старый товарищ по тек миру. Или клод поверх моего товарища, сложно сказать, но оч убедительно
долго думал, отчего вдруг на этой неделе появилось модное слово ХАРНЕСС в контексте ИИ, в буквальном переводе “упряж” (сбруя). используется для описания всего, что вокруг модели: интерфейсы, mcp, промпты, md файлы, скиллы и прочее. несколько дней фоном думал, может я чего-то не понимаю, а потом понял: это же оказалось тупо ОБВЯЗКА всю дорогу. как всегда, короче, либо Слава сильно тупит, либо хипстеры изобрели банановый-раф-кофе-на-безлактозном, либо и то и то.
Repost from from:adam
Крайне забавно, что для агентов создают такие же тулы как для людей. Все думали, что агентам не нужны будут таск-трекеры, процессы и прочее, они полностью поменяют принципы разработки софта, а по факту координировать работу нескольких агентов — та же менеджерская проблема. Скоро придумают скрам для агентов с дейли стендапами, где они будут по очереди рассказывать что делали вчера и что блокирует.
Дальше по логике — performance review. Агент-тимлид ставит своему агенту-исполнителю exceeds, выносит на калибровку, а там другие агенты-тимлиды не согласны и режут до meets. Агент-исполнитель уходит в бесконечный цикл рефлексии, токены горят, латенси растёт — выгорание. Нанимают ещё одного агента-коуча, который советует «переосмыслить цели и сделать паузу», а параллельно ищут ему замену на рынке агентов.
при общении с хедхантерами меня не покидает ощущение, что я говорю с ии агентом. если это так, то в общем-то вот они экономические последствия на лицо, хедхантеров нужно будет тупо меньше
