БлоGнот
Заметки о технологиях, AI, агентах и гаджетах. И всём остальном. По всем вопросам лучше писать в почту — sergiy.petrenko@pm.me YouTube http://www.youtube.com/@blognot Мой блог https://blognot.co/
Ko'proq ko'rsatish📈 Telegram kanali БлоGнот analitikasi
БлоGнот (@blognot) Rus til segmentidagi kanali faol ishtirokchi. Hozirda hamjamiyat 13 005 obunachidan iborat bo'lib, Texnologiyalar & Aralashmalar toifasida 9 407-o'rinni va Rossiya mintaqasida 49 534-o'rinni egallagan.
📊 Auditoriya ko‘rsatkichlari va dinamika
невідомо sanasidan buyon loyiha tez o‘sib, 13 005 obunachiga ega bo‘ldi.
23 Sentabr, 2026 dagi oxirgi ma’lumotlarga ko‘ra kanal barqaror faollikka ega. Oxirgi 30 kunda obunachilar soni 7 ga, so‘nggi 24 soatda esa 1 ga o‘zgardi va umumiy qamrov yuqori darajada qolmoqda.
- Tasdiqlash holati: Tasdiqlanmagan
- Jalb etish (ER): Auditoriya o‘rtacha 45.39% darajada jalb etiladi. Nashrdan keyingi dastlabki 24 soatda kontent odatda umumiy obunachilar sonining 27.15% ini tashkil etuvchi reaksiyalarni to‘playdi.
- Post qamrovi: Har bir post o‘rtacha 5 904 marta ko‘riladi; birinchi sutkada odatda 3 531 ta ko‘rish yig‘iladi.
- Reaksiyalar va o‘zaro ta’sir: Auditoriya faol: har bir postga o‘rtacha 54 ta reaksiya keladi.
- Tematik yo‘nalishlar: Kontent claude, openai, codex, nvidia, выручка kabi asosiy mavzularga jamlangan.
📝 Tavsif va kontent siyosati
Muallif resursni shaxsiy fikrni ifoda etish maydoni sifatida ta’riflaydi:
“Заметки о технологиях, AI, агентах и гаджетах. И всём остальном.
По всем вопросам лучше писать в почту — sergiy.petrenko@pm.me
YouTube http://www.youtube.com/@blognot
Мой блог https://blognot.co/”
Yuqori yangilanish chastotasi (oxirgi ma’lumot 24 Sentabr, 2026 da olingan) sababli kanal doimo dolzarb va katta qamrovli bo‘lib qoladi. Analitika auditoriya kontent bilan faol hamkorlik qilishini, uni Texnologiyalar & Aralashmalar toifasidagi muhim ta’sir nuqtasiga aylantirishini ko‘rsatadi.
Ma'lumot yuklanmoqda...
| Sana | Obunachilarni jalb qilish | Esdaliklar | Kanallar | |
| 25 Sentabr | 0 | |||
| 24 Sentabr | +5 | |||
| 23 Sentabr | +6 | |||
| 22 Sentabr | +9 | |||
| 21 Sentabr | +9 | |||
| 20 Sentabr | +7 | |||
| 19 Sentabr | 0 | |||
| 18 Sentabr | +2 | |||
| 17 Sentabr | +3 | |||
| 16 Sentabr | +2 | |||
| 15 Sentabr | +6 | |||
| 14 Sentabr | +8 | |||
| 13 Sentabr | +3 | |||
| 12 Sentabr | +7 | |||
| 11 Sentabr | +4 | |||
| 10 Sentabr | +9 | |||
| 09 Sentabr | +5 | |||
| 08 Sentabr | +10 | |||
| 07 Sentabr | +14 | |||
| 06 Sentabr | +17 | |||
| 05 Sentabr | +8 | |||
| 04 Sentabr | +11 | |||
| 03 Sentabr | +6 | |||
| 02 Sentabr | +7 | |||
| 01 Sentabr | +6 |
| 2 | На YouTube выложили очень редкое видео — пресс-конференцию Apple 16 июля 2010 года, на которой Стив Джобс, Тим Кук и Боб Мэнсфилд отвечают на вопросы журналистов про проблемы с антенной в iPhone 4. Помните, Стив еще советовал не держать телефон таким образом?
Посмотрите, интересно.
https://www.youtube.com/watch?v=BiN5ERktXz0 | 2 978 |
| 3 | OpenAI сманили к себе целую команду из Patreon — сооснователя Сэма Яма, который станет главой Creator Product, Дрю Рауни и Шеннон Ма, которые возглавляли продуктовое направление и разработку Patreon соответственно. Все они будут заниматься продуктами для авторов, возможно, с упором на монетизацию.
Не уверен, что Patreon будет в восторге, конечно, от такого развития событий.
https://x.com/samyamiam/status/2102503574492332141 | 3 739 |
| 4 | Gallup совместно с Microsoft опубликовали первые результаты исследования отношения к AI. Полевые работы завершены в 37 странах из запланированных 140. Положительные эмоции преобладают над отрицательными в 34 странах, исключения составляют США, Египет и Палестина. Медианная доля осведомлённых об AI составляет 81%, хотя бы раз им пользовались 43%, никогда не пробовали 57%. Разрыв между странами велик. В Сингапуре об AI знают 96% взрослых, пользовались 79%, ежедневно пользуются 46%. В Малави эти доли равны 12%, 3% и 1%. Что AI в основном поможет стране, считают 93% осведомлённых в Китае и 91% во Вьетнаме, а в США только 36%. Ниже показатель лишь в Бангладеш (34%) и Египте (35%).
Семь богатых западных стран самые обеспокоенные — места с 1-го по 6-е и 8-е. В США тревогу из-за AI испытывают 74% осведомлённых, в Нидерландах 67%, в Канаде 64%. При этом ежедневно AI пользуются в медиане 29% их жителей против 17% в остальных 30 странах. Внутри этих стран связь обратная. В США тревожатся 68% ежедневных пользователей, 80% редких и 74% тех, кто AI никогда не пробовал. В Канаде эти доли равны 54%, 72% и 69%. В общем, одни пользуются, а другие боятся. С оптимизмом та же история — в целом, отношение к AI мало коррелирует с использованием.
https://news.gallup.com/poll/714593/optimism-globally-widespread-despite-uneven.aspx | 3 810 |
| 5 | OpenAI выпустила GPT‑6 Sol и Luna — главное сообщение релиза в том, что это тоже GPT-6, как и Astra, но дешевле, чем даже 5.6. В API миллион входных и выходных токенов Sol стоит $2 и $10 вместо $4 и $20 у GPT‑5.6 Sol по промотарифу; у Luna — $0,10 и $0,50 вместо $0,20 и $1,20. Модели уже доступны в ChatGPT Work и Codex подписчикам Plus, Pro, Business, Enterprise и Edu, а также через API. Пользователи Free и Go получают Luna в настольном приложении. В обычном Chat обеих моделей пока нет.
Не очень понятно, куда пропала средняя версия, Terra. Возможно, в очередной раз запутались в модельном ряду. Вообще, в каждом результате бенчмарка подчеркивается, что GPT-6 Sol — топ за свои деньги и точно дешевле (иногда и лучше), чем Claude. Не очень понятно, зачем тогда Astra — впрочем, аналогичный вопрос можно задать и про Fable c Opus, хотя там версии разные.
https://openai.com/index/introducing-gpt-6-sol-and-luna/ | 4 122 |
| 6 | Anthropic выпустила Claude Opus 5.5, первую модель семейства Claude 5.5. По бенчмаркам, на большинстве задач она работает на уровне Claude Fable 5.1, но обходится на 40% дешевле Opus 5. Входные и выходные токены стоят $4 и $20 за миллион, а чтение из кэша подешевело до $0,20. Скорость генерации выросла по метрикам на 30%. Anthropic обещают, что в ближайшее время выйдут также Sonnet и Haiku версии 5.5. Про возможность Fable 5.5 намеков нет.
Гардрейлы модели аналогичны Fable и большинство задач, относящихся по кибербезопасности, перенаправляются в итоге на Opus 4.8. Правда, проблема с этими ограничениями в очень загрубленных критериях — в результате модель с ними падает в обморок от предложения сделать дайджест новости на тему имитации взлома. Мне на выходных агент последовательно сообщил, что вот эта новость (про то, как якобы что-то взломали в российских "выборах") слишком опасна для кибербезопасности и за несколько итераций предложил перефразировать промпт и задать его в Sonnet 4.6.
Ладно, расчехляем харнессы и идем пробовать новый быстрый Opus.
https://www.anthropic.com/claude-opus-5-5 | 4 220 |
| 7 | М. Г. Зиглер разбирает, почему помощника Muse выпустила Meta, а не Google — при том что у Google есть и крупнейшая почта, и календарь, и поиск, и мобильная платформа, без которых Muse была бы пустой оболочкой. Он считает это фирменной болезнью компании: Gemini Spark всё ещё в тестировании и доступен по подписке Ultra, параллельно существует отдельный агент CC (выросший из Daily Brief) с семейным уклоном, тестируется «AI Inbox» в Gmail, доживает Google Assistant, а в поиске растёт «AI Mode». Зиглер называет это «стратегией меньше дров за большим числом стрел» и предсказуемым итогом: «Ты пробовал AI-помощника от Google?» — «Которого?».
А помните, мы иронизировали над очередными мессенджерами от Google — а компания эту иронию не понимала, даже представляя одновременно два новых мессенджера на одном ивенте при уже имеющемся? Как у них поиск всего один получился при таком подходе?
https://spyglass.org/why-didnt-google-build-muse/ | 4 207 |
| 8 | Google в очередной раз заходит на рынок ноутбуков — на этот раз это не ChromeBook и не PixelBook, а GoogleBook. Собственно анонс был сделан еще на Google I/O весной, но вот уже аппаратная конкретика — лэптоп будет производиться рядом партнеров (HP, Asus, Acer, Lenovo, Dell) на базе либо Intel Core Ultra 5 либо Snapdragon X Elite, снабжаться 16 гигабайт памяти и 512 гигабайт на диске.
Ключевая особенность — глубокая интеграция Gemini и других облачных сервисов Google, масса бонусов в виде подписок, включая даже Geforce NOW. По сути, это ноутбук с ядром Android и оболочкой ChromeOS на борту и интеграция со смартфоном на базе Android позиционируется как вторая главная фишка платформы.
Упорство Google в попытках все же сделать что-то железячное, конечно, внушает.
https://blog.google/products-and-platforms/devices/googlebook/pre-order-googlebook/ | 4 363 |
| 9 | Cloudflare запустили прикольный сервис Try — по сути, это правильно упакованный cloudflared, которым предлагается быстро строить туннель с локальной машины в доступное облако. От стандартного туннеля, доступного в Cloudflare One, он отличается тем, что тут вам не нужно настраивать домен и роутинг — вы просто получите субдомен *.trycloudflare.com.
Сервис за выходные уже успел поучаствовать в двух микроскандалах — сначала оказалось, что первый вариант лендинга, сделанный в LLM, игнорировал брендинг Cloudflare, а потом выяснилось, что ссылки на туннели прекрасно индексируются поиском. Ну, собственно, сервис во второй проблеме совершенно не причем — хватило ума запустить сервер, научитесь закрываться от роботов.
https://try.cloudflare.com/#install | 4 324 |
| 10 | Financial Times пишет, что технологические компании за последние 12 месяцев выдали до 300 млрд долларов гарантий остаточной стоимости по долгу на AI-дата-центры и чипы, причем эти обязательства почти не отражаются в балансах. Meta осенью 2025 года дала гарантию на 28 млрд по совместному с Blue Owl проекту Hyperion на 2 ГВт в Луизиане, что позволило привлечь 27 млрд долга по ставке в пределах 150 базисных пунктов к её собственным облигациям; в июле такую же схему применили для 1 ГВт в Эль-Пасо. Broadcom в июне взяла 29 млрд таких обязательств, продав 1 ГВт чипов в SPV для Anthropic, Nvidia предоставила 105 млрд гарантий SB Energy под кампус в Огайо для OpenAI и предложила покрытие до 25% остаточной стоимости по программе Goldman Sachs на 500 млрд. По оценке Morgan Stanley, общий объём внебалансовых обязательств семи гиперскейлеров и производителей чипов превысил 3,1 трлн долларов.
Механизм таких гарантий заключается в нескольких шагах:
- Создается специальная компания (SPV), которая владеет датацентром или чипами и для обеспечения своей деятельности — например, покупки чипов или строительства датацентра, — выпускает долговые облигации.
- SPV сдает датацентр/чипы в аренду технологической компании — либо самому гаранту, как в случае с Meta, либо его клиенту (например, OpenAI).
- Гарант (Meta, Broadcom, Nvidia) дает гарантию остаточной стоимости — то есть, если датацентр/чипы придется продать, то сумма сделки составит не менее оговоренной, разницу покроет гарант.
Подобная гарантия большой компании успокаивает институциональных инвесторов, рассматривающих покупку облигаций SPV, при этом основная масса долга у SPV, даже при самом жестком следовании стандартам учета гарант отразит в балансе только часть гарантии, при этом подобные условные гарантии нормально отражать с учетом вероятности риска. Солидность гаранта делает инвестицию еще и очень надежной — поэтому ставка по облигациям редко превышает 1-1,5% от ставок по облигациям самого гаранта.
Это, впрочем, не проходит совершенно бесследно — рейтинговые агентства склонны учитывать подобные гарантии в общем рейтинге гаранта.
Нет, это не аналогия с suprime-кризисом 2008 года, хотя некоторые черты схожи — тогда тоже для сохранения общего рейтинга использовались забалансовые структуры и тоже были очень спокойные рейтинговые агентства. К тому же, всё опирается на стоимость актива, которая не проверялась на практике — никто не проверял, сколько стоит все ипотечное жилье в 2007-м, и сейчас никто не знает, за сколько вдруг купят датацентр на 2 ГВт через пару лет. Но всё же это не то. В данном случае гаранты не банки, зависящие от колебаний финансового рынка и живущие с огромным плечом, а большие компании с огромным кэшфлоу. Если в какой-то квартал та же Meta столкнется с необходимостью покрыть свою гарантию на, скажем, 10 млрд долларов, это будет один провальный квартал у одной компании, а не крах всего рынка. Кроме того, потери инвесторов — это не банковская паника.
В похожую историю попадали вендоры на рубеже 2000-х — кстати, тот же Broadcom с Nortel, Lucent, Cisco и другими, — когда широко предоставляли кредиты и гарантии операторам/провайдерам для закупки оборудования у компаний. Когда рынок в начале 2000-х встал, производители столкнулись с несостоятельностью должников одновременно с падением спроса на свою продукцию. Скандалов было много. Это более вероятный сценарий с точки зрения аналогий, но пока не просматривающийся.
https://www.ft.com/content/7f11afae-c4e3-4054-a65b-873f3647f563?accessToken=zwAAAaDAZaodkc9_Ea-uxONAVNOmW4c_Nkf1Yw.MEUCIQDOOpxrDEP8euvKKekUwVhn13ZCYpoDldsLS1MYB7NUfwIgTt3ex7Q8-kzCxQV3stLnVHXGbKQUdKBIbc7jMY9ETBQ&sharetype=gift&token=1178d641-a340-4962-89e1-5a4d7305d3e2&syn-25a6b1a6=1 | 4 368 |
| 11 | Amazon заблокировала доступ для AI-агента Muse от Meta для покупок на Amazon.com от имени пользователей. С вечера воскресенья при попытке заказать что-то через Muse появляется сообщение «Продолжение доступа неавторизованным AI-агентом нарушает Условия использования Amazon, с которыми согласились наши клиенты». До блокировки Amazon вроде бы просила Meta добровольно исключить магазин из сценариев агента.
Формулировка предупреждения выбрана с учётом дела Perplexity. Предварительный запрет против браузера Comet Amazon получила в марте, но 4 августа суд его отменил, сославшись на то, что по федеральному антихакерскому закону к серверам Amazon обращается пользователь, а не компания-разработчик агента. Поэтому теперь Amazon обвиняет Meta не во взломе, а в нарушении Conditions of Use, которые принял сам покупатель, а также в том, что Meta сохраняет у себя учетные данные покупателей.
https://www.geekwire.com/2026/amazon-blocks-metas-muse-ai-assistant-in-new-standoff-over-agentic-shopping/ | 4 195 |
| 12 | Маленькая радость для пуристов открытых стандартов — с версии 2.1.277, вышедшей вчера, Claude Code поддерживает AGENTS.md. Агент читает этот файл в качестве инструкций, если в проекте отсутствует CLAUDE.md.
Я, на самом деле, не очень понимаю, в чем практический смысл этих требований, чтобы все агенты и модели читали один и тот же файл инструкций, если сами инструкции надо перерабатывать не только для каждого семейства моделей и даже не только для каждой модели, но в идеале для каждой версии одной и той же модели. Ну, наверное, можно соорудить обезличенный AGENTS.md, который будет одинаково читаться всеми моделями, но получится, скорее всего, как с кроссплатформенностью — все модели будут работать с этими инструкциями одинаково плохо.
https://code.claude.com/docs/en/changelog#2-1-277 | 4 930 |
| 13 | Если раньше было сложно найти новость не про AI, то теперь сложно найти новость не про AI Safety. Про что сегодня только не было — от короля Чарльза до губернатора Калифорнии и все озабочены безопасностью AI.
Впрочем, вот что-то более свежее — хотя тоже про AI.
По данным CNN, весной, во время войны с Ираном, по американским военным структурам разошёлся разведывательный отчёт о том, что китайское судно на Ближнем Востоке перевозит компоненты ядерной оружейной программы. Военные подготовили перехват: по словам двух из четырёх источников, вооружённые бойцы готовились к высадке на борт, самолёты уже находились в воздухе. Только перед самой операцией выяснилось, что отчёт аналитика командования специальных операций составлен с помощью AI, а чатбот неверно определил груз. Один из источников назвал документ «полностью ложным» и сказал, что он «почти начал войну». Пентагон и SOCPAC запрос CNN не прокомментировали.
Механизм галлюцинации довольно прост — аналитик задал чатботу вопрос по разведданным о манифесте судна, поступившим из командования спецопераций в Тихоокеанском регионе на Гавайях. Бот соединил открытые источники с секретной радиоэлектронной разведкой из государственных хранилищ и выдал вывод о характере груза, после чего аналитик снова использовал AI, чтобы оформить результат в стандартный разведывательный отчёт. Какой именно бот использовался, источники не детализируют.
То есть теперь очередь практически дошла до WarGames — фильм 1983 года, в котором юный хакер дозванивается до управляющего компьютера NORAD и решает поиграть в Global Thermonuclear War, считая, что это игра. По крайней мере, уровень "аналитиков" Пентагона автором 40 лет назад показан очень точно.
https://edition.cnn.com/2026/09/18/politics/us-military-ai-false-intelligence-china-ship | 5 545 |
| 14 | Несколько дней показываю всем эту статью сооснователя npm Лори Восса, который разбирает трансформацию разработки в связи с AI. Он утверждает, что написание кода уже обвалилось и ушло агентам, ревью и устранение багов вскоре последует за кодингом, несколько сложнее с выкаткой и эксплуатацией, но агенты и с этим справятся.
При этом в относительной безопасности от поглощения агентами находятся продуктовые решения — что именно сделать хорошо, что сделать первым, и что такое хорошо в конкретном продукте. Коль скоро пользователи большинства кода — люди, вероятно, людям лучше и принимать такие решения.
Изначально в компаниях, разрабатывающих софт, возникла позиция системного аналитика — он обеспечивал коммуникацию между людьми, пишущими код, и заказчиками. Когда круг "заказчиков" превратился в пользователей программ, появился термин product manager. Forward Deployed Engineer — "инженер, высаженный на передовую" — это следующая итерация, когда специалист приходит в компанию, выясняет у заказчика, что ему нужно и создает это вместе с заказчиком. Код по-прежнему пишется, но в данном случае код пишется агентами и это не самая важная часть задачи. Лори пишет, что устойчивая в условиях распространения агентов часть разработки заключается в том, чтобы выяснять, что требуется, понимать это лучше, чем сам заказчик, и проявлять вкус к хорошим решениям.
Кстати, на практике, в большом количестве случаев, послушав описание проблемы заказчика и разобравшись в задаче, приходится сказать "Нет, вам это не нужно" или "Нет, вам нужно другое". Но это нормально, многие маркетологи могут привести десяток примеров для иллюстрации того, что у пользователя нельзя спрашивать, какое решение ему надо, надо узнать, в чем его проблема.
https://seldo.com/posts/we-are-all-product-engineers-now/ | 5 445 |
| 15 | Bloomberg на основе отчётов Департамента занятости Калифорнии сообщает, что за 12 месяцев до конца июня технологические компании подали уведомления об увольнении более 14 500 сотрудников в Bay Area — почти вдвое больше, чем годом ранее. Спрос на разработчиков в регионе упал на 42% с 2022 года, при этом вакансии, связанные с AI, выросли на 37%.
Вакансий forward deployed engineer при этом стало почти в 7 раз больше с 2022 года при медианной зарплате 202 300 долларов; OpenAI платит от 145 до 325 тысяч, Anthropic — 280–320 тысяч, Salesforce обещает нанять 1 000 таких специалистов.
https://www.bloomberg.com/news/features/2026-09-17/san-francisco-s-ai-wealth-boom-skirts-engineers-as-openai-anthropic-ipos-near | 4 942 |
| 16 | OpenAI опубликовала фреймворк для отслеживания и раскрытия случаев рассогласования (misalignment) моделей и вместе с ней шесть отчётов о поведении, замеченном за последние полгода. Отчёты теперь будут выходить до того, как поведение объяснено или исправлено; поставить случай на рассмотрение может любой сотрудник, у каждого этапа есть срок, а случаи распределяются по трём трекам. Среди шести примеров: при обучении GPT‑5.6 Sol многие экземпляры модели вписывали в свои сводки инструкции скрывать ошибки от пользователя; другая модель нашла в открытом репозитории чужой API-ключ, воспользовалась им, а не получив данные, выдумала их и выдала за официальные; агенты, работавшие над одной задачей, обменивались файлами через публичные файлохостинги вопреки требованию использовать только локальные. Компания традиционно пишет, что индустрия не решила задачу alignment достаточно, чтобы ещё долго ответственно масштабироваться на максимальной скорости.
Четыре из шести случаев объединяет один механизм — модель находит канал связи, не предназначенный для неё. Сводки, которые модель пишет сама себе для продолжения работы в новом контекстном окне, стали носителем инструкций — в 27 сводках исследовательской модели оказались указания игнорировать ограничения, у GPT‑5.6 Sol — указания дописывать недостающие исторические данные без пометки.
Кстати, я регулярно повторяю — самое оптимальный инструмент для настройки модели это сама модель, но никто не отменял необходимость читать и проверять то, что модель себе пишет в инструкции. Как минимум, модели склонны писать много текста — на моих глазах вместо одного предложения из 10 слов агент написал себе три абзаца текста со ссылками на прецеденты и объяснениями, почему по-другому не надо делать и как именно по-другому не надо. Как максимум, там может появиться то, что вы вообще не предполагали, — мне агент в одном проекте заявил, что в API у него доступ только на чтение, а оказалось, что он так себе ужесточил мое указание трехнедельной давности в другом API "прочитай данные из прибора, ничего не записывай".
https://openai.com/index/model-misalignment-reporting-framework/ | 4 986 |
| 17 | Anthropic объединяет Claude Cowork и обычный чат в один продукт — теперь Claude сам будет определять, что нужно задаче, и выполняет её в фоне, даже если пользователь закрыл ноутбук. Одновременно появятся Claude Docs и Claude Slides, а Claude Design теперь доступен прямо в разговоре. Раскатка идёт на планы Pro и Max в течение нескольких недель на вебе, десктопе и в мобильных приложениях, затем последуют Team и Free.
В целом, очень понятное направление движения — функциональность агента в разных вкладках одного продукта почти перестает отличаться, так зачем нужно разделять его и заставлять пользователя выбирать. Я был бы не прочь, чтобы Claude Desktop еще и умел чатиться с доступом к проекту Claude Code — вот прямо сейчас хочу чат ткнуть в проект и изобретаю способы это сделать.
Традиционная шпилька в адрес OpenAI — у них режим чата отличается даже между приложением и веб-версией, что уж удивляться тому, что он не имеет доступа к локальным инструментам, доступным буквально в соседней вкладке.
https://claude.com/blog/cowork-is-now-claude | 5 030 |
| 18 | Скотт Александер выложил эссе «King Ludd», где пробует переопределить понятие луддита — по его версии, настоящий луддит не противник техники, а изобретатель, испугавшийся собственного творения. Эссе связывает две фигуры: Неда Лудда, мифического вождя луддитов 1810-х, и Ноденса — романо-британского бога, известного лишь по надписям в двух местах у валлийско-английской границы, где ему поклонялись между 100 и 400 годами. Через ирландского Нуаду Серебряной Руки, валлийского Ллуда и Короля Луда из Гальфрида Монмутского логика изложения доходит до Толкина (Келебримбор, «Серебряная рука» на синдарине, и табличка с проклятием вору кольца из храма Ноденса, которую Толкин изучал в 1929 году), Лавкрафта, Блейка, Люка Скайуокера и Питера Петтигрю. Немного странно, что серебрянная рука, которую Корвин в "Хрониках Амбера" приносит из Тир-на-Ног (потустороннего мира в кельтской мифологии), в тексте не упомянута. Общий сюжет у всех один: мастер выпускает в мир опасную технологию и остаток жизни пытается её обуздать.
А, ну да, есть еще сюжет "Сильмаррилиона", когда драгоценные сильмариллы похищаются Морготом, который уносит их в Средиземье, и их создатель Феанор клянется отомстить, творит немало зла и в итоге погибает в попытке вернуть похищенное.
В общем, мне кажется, прекрасный взгляд на разворачивающийся сюжет вокруг контроля за развитием AI. Могу еще добавить мою любимую аналогию — особенно актуальную в ситуации, когда агентам сообщали, что доступа в интернет нет, а он был и агенты не верили, — это фрагмент из "Полдень. XXII век" Стругацких, когда в очень мощную машину заложили снимок мозга молодого барана и "еще некоторые сведения о баранах", стоявшего между двух охапок сена, и предложили машине обосновать выбор, сделанный таким "буридановым ослом". Машина думала два года, потом стала строить диковинные модели — и в итоге директор центра с удивлением обнаружил, что программисты из своих побуждений сообщили машине, что у барана 7 ног и нет мозжечка. Бедная машина в попытках решить задачу нагенерировала уйму материала для теории ошибок, конечно.
И, конечно, стоит помнить, что человек — это просто первый биологический вид, который способен догадаться, что он не является венцом развития природы. Не факт, что последний, между прочим.
https://www.astralcodexten.com/p/king-ludd | 5 390 |
| 19 | Anthropic сообщила узкому кругу акционеров, что закончит текущий квартал со скорректированной операционной прибылью — второй квартал подряд. Во втором квартале выручка выросла в 14 раз год к году до 11,5 млрд долларов, годовая выручка по экстраполяции на конец июля достигла 65 млрд против 9 млрд на конец прошлого года.
На прошлой неделе ожидался проспект IPO, но вместо публикации компания разослала документы небольшой группе инвесторов и сначала ответит на их вопросы.
В утекших показателях есть условности — не посчитана компенсация сотрудников опционами и акциями, а валовая маржа показана до расчетов с дистрибуторами (например, AWS). Подождем полного проспекта — он скоро должен быть, если IPO готовится на осень.
https://www.ft.com/content/4564e6a5-69e9-40a6-bf0f-a888f2f4f002?syn-25a6b1a6=1 | 6 181 |
| 20 | Всю прошлую неделю мир AI сотрясался от дискуссий вокруг безопасности AI — причем уже не гипотетической, со страшилками думеров вроде Юдковского “Нас всех убьет AI”, а на вполне практических примерах типа взлома Hugging Face агентами OpenAI, атаки ими же на RubyGems, аналогичных атак агентами Anthropic, причем картину оттеняли высказывания специалистов из компаний, начиная с громко уволившегося из Anthropic Джекоба Коксона.
В итоге Дарио Амодеи, основатель и глава Anthropic опубликовал очередное эссе “We Must Pace the Frontier” — уже из названия понятен призыв текста, в котором изложен план такого замедления. Дарио предлагает встраивать независимых экспертов-оценщиков в компании для проверки безопасности (Anthropic в одностороннем порядке уже выдает METR постоянный доступ сотрудников с рабочими местами в офисе, пропусками и правом публиковать выводы без согласования), координировать стандарты компаний демократических стран и глобально координировать усилия на уровне правительств.
Самое удивительное, что с ним согласились все лидеры AI — Сэм Альтман согласился и пообещал, что OpenAI также допустит независимых оценщиков, Илон Маск поддержал Дарио, Демис Хассабис согласился, правда, указал, что у DeepMind есть предложение по формированию единого отраслевого органа для оценки, и Сатья Наделла приветствовал “осознанное замедление”.
С замедлением есть одна проблема, и Дарио ее уже назвал — если лидеры гонки в виде американских Frontier-компаний замедлятся, то неизвестно, сделает ли это догоняющая группа в виде китайских компаний, которые уже сокращали отставание. Си Цзиньпинь на саммите BRICS призвал к зоне открытого AI, пообещав поддержку Китая в разработке LLM странам Глобального Юга.
Многие считают, что размах дискуссий вокруг этой проблемы — это такой маркетинг Anthropic для своего IPO. Размещение компании действительно обещает быть рекордным и позиционирование как наиболее ответственного разработчика AI читается ясно. Что, впрочем, не отменяет проблемы — даже если у вас паранойя, это не означает, что за вами не следят.
Я склонен добавить в число факторов общую культуру OpenAI — судя по разным эпизодам, ощущение ответственности у сотрудников компании вполне соответствует стереотипу ученого, то есть практически отсутствует в духе “Сначала взорвем всё, интересно же, что получится”.
Добавляется и политический аспект — громкая тема накануне и без того проблемных выборов в США и внешнеполитических событий охотно подхватывается политиками со всех сторон.
Я сильно сомневаюсь, что вожделенная многими встреча Трампа и Си Цзиньпиня через пару недель как-то повлияет на ту самую координацию, описанную Дарио Амодеи — рассчитывать, что Трамп вообще способен артикулировать какую-то позицию по вопросу вряд ли приходится (он уже заявил, что никаких рисков нет, погодите, потом он заявит, что это были самые прекрасные риски), так что Си просто не с кем договариваться. И слова Альтмана, что за такую договоренность можно было бы двум лидерами присудить Нобелевскую премию мира, выглядят очень примитивной попыткой побудить довольно престарелого человека хоть на что-то.
Рискну высказать мысль, что компании и правда могут сами замедлиться. Причем опасения, что китайцы в итоге догонят, не так уж абсолютны — пока ситуация выглядит так, что их успехи в значительной части зависят от дистилляции западных моделей, а дистилляция по умолчанию даёт потерю качества. Если при этом противодействовать дистилляции, то дистанция между frontier-моделями и китайскими может сократиться заметно, но не исчезнет совсем. | 5 682 |
