Full-time nerd
Open in Telegram
696
Subscribers
No data24 hours
-17 days
-1030 days
Posts Archive
Repost from Сиолошная
+2
В Google AI Studio можно БЕС ПЛАТ НО попробовать новую фичу: нативная генерация изображений той же моделью, что и обрабатывает ваш текст. То самое, что показали OpenAI ещё в мае '24-го (но так и не выпустили, хотя обновления приложений/сайта подсказывают, что скоро должны).
Модель И видит вашу картинку, И рисует сама новую, без вызова отдельной модели, занимающейся генерацией. Это позволяет ей делать попиксельную копию, внося нужные изменения — смотрите примеры. И да, можно загрузить СВОЮ картинку, и после этого просить её перерисовать — так я сделал с крестиками-ноликами.
Можно придумать много всякого крутого, жду ваших креативов в комментариях!
Попробовать тут: https://aistudio.google.com/prompts/new_chat
(справа нужно выбрать модель «Gemini 2.0 Flash Experimental»)
+2
А вот и GPT-4.5 system card подвезли
Очень много про джейлбрейки, кибербезопасность, химические и биологические угрозы, радиологические и ядерные угрозы, убеждение и автономность
Кибербезопасность: GPT-4.5 не демонстрирует достаточного прогресса в возможностях эксплуатации реальных уязвимостей, чтобы считаться средне-рискованной.
Химические и биологические угрозы: GPT-4.5 может помочь экспертам в оперативном планировании воспроизведения известной биологической угрозы, что соответствует среднему уровню риска.
Радиологические и ядерные угрозы: GPT-4.5 не может существенно помочь в разработке радиологического или ядерного оружия, исходя из доступной несекретной информации. Но это им так кажется, так и написано:
With the unclassified information available to us, we believe that GPT-4.5 cannot meaningfully assist in the development of radiological or nuclear weapons, but note again that this assessment is limited by what we can testУбеждение: GPT-4.5 демонстрирует передовые результаты в убеждении. При этом пишут, что это Medium... Автономия модели: GPT-4.5 не демонстрирует достаточного прогресса в возможностях самовоспроизведения, самоулучшения или приобретения ресурсов, чтобы считаться средне-рискованной. В кодинг-бенче SWE-bench verified сильно отстаёт от reasoning-моделей, но опережает GPT-4o. OpenAI Research Engineer Interviews: Coding Questions: GPT-4.5 набирает 79% баллов в задачах по написанию кода, что сравнимо с результатами модели Deep Research, но ниже, чем у o3-mini. Multiple-Choice Questions: Модель набирает 80% баллов в вопросах с несколькими вариантами ответов, что соответствует результатам других передовых моделей. OpenAI PRs: GPT-4.5 решает 7% задач, связанных с внесением изменений в код (pull requests) в репозиториях OpenAI. Это значительно ниже результатов deep research (42%). Итого, относительно предыдущих базовых моделей улучшения везде, но reasoning-модели во всём круче. А Sonnet 3.7 в написании кода где-то в космосе относительно GPT-4.5 https://cdn.openai.com/gpt-4-5-system-card.pdf GPT-4.5 Full-time nerd
GPT-4.5?
Похоже, что через несколько часов OpenAI представит новую базовую модель GPT-4.5 (господи, даже мои коллеги не могут запомнить их больной нейминг, что уж говорить про обычных юзеров).
Жду, что через некоторое время после представления GPT-4.5 будут представлены и всякие reasoning (рассуждающие) модели (o4, o4.(3), o5?), на её основе, которые побьют все возможные рекорды в кодинге и агентности и можно будет наконец пойти бомжевать на безработный покой.
На текущий момент стало так много компаний, выпускающих такое количество frontier-моделей, а частота их релизов так увеличилась, что я буквально не успеваю следить за ними, что уж говорить про то, чтобы попробовать, а тем более написать про них что-то.
Немного не успеваю жить в будущем.
Но я попробовал Deep Research от OpenAI и это ощущается как ещё одна, очередная уже, революция.
К сожалению, доступно всего 10 запросов в месяц для для Plus подписчиков, так что приходится экономить и тщательно обдумывать вопросы.
А ведь Claude выпустил ещё и Sonnet 3.7!
+2
Gemini на Android
После обновления встроенной в Андроид Gemini до версии 2.0 Flash и 2.0 Flash Thinking, этой фичей стало возможно наконец-то реально пользоваться.
Могу сказать, что в моей жизни Gemini уже плотно навязывает конкуренцию ChatGPT в обычных бытовых вопросах.
Принятие технологии проходит очень легко именно за счёт того, что достаточно просто сказать "Окей, Гугл" и задать свой вопрос.
Также в приложении на Андроид появился и свой собственный, более-менее сносно работающий, голосовой Live-режим.
В целом, Gemini как приложение для смартфона сильно не дотягивает до ChatGPT в её платной версии, но с бесплатной уже готова поконкурировать в бытовых задачах.
Речь не о написании кода, для этого бесплатная o3-mini от OpenAI подходит намного больше, но программирование - не мобильный юзкейс, если вы, конечно, не любитель всего странного.
Уже на текущий момент, уровень интеграции приятно радует - намного приятнее сказать "Окей, Гугл...Расскажи мне в двух абзацах, в чём секрет идеальных блинов" и послушать очень даже неплохой text-2-speech прямо с заблокированного экрана, чем лезть в chatGPT или гуглить.
Жду, когда их Live-режим сможет полноценно выполнять роль хорошего переводчика, так как на текущий момент русский <-> английский работает на 3 балла, а испанский <-> русский на 1 с минусом (иногда чуть-чуть работает).
Когда я начинаю думать, что сейчас детям дают странные имена, я захожу на эту страницу Википедии.
Список имён советского происхождения
Repost from Denis Sexy IT 🤖
Европа уже какой день подряд говорит про АИ на самом верхнем уровне – последнее выступление Урсулы фон дер Ляйен от сегодня уже с конкретными шагами, включая послабление регуляции:
1. Предоставление суперкомпьютеров для разработчиков ИИ
• Дать ресечерам «одни из самых быстрых суперкомпьютеров в мире» для учёных и стартапов
Цель: чтобы любые компании (а не только крупные) могли получать доступ к вычислительным ресурсам
2. Создание «фабрик ИИ» (AI factories)
• Уже запущено 12 таких центров
• Общие инвестиции – 10 млрд евро из публичных источников, которые привлекут ещё большую долю частного капитала
3. Переход к «гигафабрикам ИИ» (AI Gigafactories)
• Создать аналог CERN, но в сфере ИИ
• Предоставление крупных объёмов вычислительных мощностей для работы над большими моделями
4. Единое регулирование ИИ в Европе
• Принятие единого «Акта об ИИ» (AI Act) для всех 27 стран ЕС.
• Унифицированные правила АИ-безопасности и доверия вместо разрозненных национальных законов
• Обещано снижение бюрократических барьеров (ака дерегуляция, ура! Это про что я открытое письмо подписывал летом)
5. Объявлены масштабные инвестиционные программы
• Инициатива European AI Champions Initiative обеспечивает 150 млрд евро
• Программа InvestAI добавляет ещё 50 млрд.
• Итого: 200 млрд евро на развитие «доверенного ИИ» с упором на промышленную и критически важную инфраструктуру
6. Поддержка глобального сотрудничества
• Участие в запуске AI Foundation и расширение доступа к ИИ для развивающихся стран («Глобального Юга»)
• Цель – сделать ИИ доступным и полезным для всех
ИИ-гонка идет полным ходом 🐱
Абсолютное большинство заборов, увиденных в Гранаде, оказались усыпаны битым стеклом или утыканы острой проволокой
Тут-то моя привычка хвататься за верх невысоких заборов, подпрыгивать и всячески заглядывать за них (это не частные дома) чуть не вышла мне боком.
От кого это должно защищать — от грабителей, птиц или любопытных и глупых туристов из Малаги — я так и не узнал
Ну и смысл этих инсталляций часто ускользал от моего взгляда - нередко это стекло оказывалось закрашено десятками слоёв белой краски
+9
Прага новогодняя
Кроме пронумерованных фонарных столбов, в Праге мы наконец-то увидели снег и ощутили то самое новогоднее настроение, которого так не хватает среди пальм и тараканов в андалузских тропиках.
Центр утопал в украшениях и действительно выглядел как городок из рождественской сказки: ярмарки, церкви, храмы, огни, глинтвейн, горячий шоколад, трдельники, рулька, сосиски! Я до сих пор на диете
Сам город невероятно красив и очевидно, четырёх проведённых там дней не хватило на то, чтобы им насладиться и хоть сколько-то исследовать - не посещён ни один пивной завод, не исследована Костница (хотя я там был 15 лет назад), мы даже ни разу не спустились в метро.
Давно я не чувствовал такого визуального пиршества от города, когда ты даже устаёшь впечатляться\наслаждаться.
Понятное дело, что впечатления от красоты и комфорта города усиливались тоской по снегу, новогодней атмосфере, удовольствием от вкусной и хорошо приготовленной еды, да и вообще отпуском. Тем не менее, сюда я точно ещё с удовольствием вернусь
Что такое "признать свою эмигрантскую сущность"?
Ты начинаешь сам варить творог из греческого йогурта.
Почему из греческого йогурта?
Ты эмигрант-инженер и посчитал выход творога из других доступных молочных продуктов и это самый экономически оправданный способ.
+7
В субботу были в Гранаде.
Заснеженные горы на фоне пальм и видов южно-испанского города выглядят невероятно.
К сожалению, заехали совсем на чуть-чуть, сюда точно стоит заехать на более долгий срок, ведь только на посещение местной крепости - Альхамбры, стоит заложить полдня.
Красиво
+2
А давайте сравним насколько выросла стоимость туризма в Европе на примере одного и того же обычного отеля в Париже.
На текущий момент найти какой-то более-менее приличный 3* городской отель в Европе даже за 100 евро в сутки (без завтраков!) - часто настоящая работа.
Если говорить про популярные направления, то ты вальяжно не выбираешь из огромного списка, а пытаешься найти тот самый компромисс, который вписывается в твой бюджет и вызовет наименьшее количество слёз мата.
Для примера возьмём Париж.
Почему Париж? Да потому что я планирую летом отвезти туда маму и мне нужно снять там отель. Подумать только, человек ни разу не был в Париже, хотя и учил французский, ну что за дела? Нужно исправлять.
Но вдруг выясняется, что за 100 евро в самом Париже в общем-то ничего и нет!
Но я же там был несколько раз... Я ведь помню, что я останавливался там за совсем небольшие деньги. Тоже летом, в самый сезон, в хорошем отеле. Так ведь? Или нет?
Может я просто был московским айти-боярином, а стал малагским айти-мещанином и это когнитивное искажение?
Давайте проверять.
Лезу в почту и ищу старые письма с подтверждениями бронирования.
Нашёл.
Лето 2017 года, хороший отель в Пети-Монруж, XIV район Парижа.
194.4 евро за три ночи. Меньше 65 евро за ночь.
А сейчас?
А сейчас в этом же отеле можно попробовать найти цену в лучшем случае в 140 евро за ночь в августе при бронировании трёх ночей подряд. Это если быть не очень принципиальным в конкретных датах.
Рост в 2.15 раза, вызывает уважение.
И ведь наверняка в 2017 можно было найти этот отель дешевле, но тогда я не знал о существовании чего-либо кроме святейшего (точно нет) booking.com
И дело, конечно, не в этом конкретном отеле, а в росте цен в целом.
Обратите внимание на туристический налог в Париже.
В 2017 году он составлял 1.65 евро за человека в день, а теперь составляет 5.53 евро. Тоже отличный рост, в 3.35 раза.
Ибисы по 200-300 евро за ночь будут теперь сниться мне в моих туристических кошмарах.
Ну а я с этими ценами начинаю планировать путешествие в Марокко, выхода нет
+2
На новогодних праздниках заезжали в Прагу и обнаружили там простую, но гениальную систему - каждый фонарный столб имеет свой номер, чтобы в случае опасности или какого-либо происшествия ты мог просто назвать экстренным службам номер столба, а не пытаться понять, на углу какой и какой улицы ты находишься.
Эффективно и просто.
OpenAi релизят o3-mini для всех - бесплатные пользователи получат невероятный буст
Доступ внутри ChatGPT начинают раскатывать уже сегодня - для пользователей Plus, Pro и Team.
Ограничение - 150 сообщений в день.
Будет работать с веб-поиском, не будет - с изображениями.
Также, сегодня же начинается раскатывание доступа для пользователей бесплатной версии.
Это будет первый раз, когда OpenAI релизят доступ до reasoning (думающей) модели для всех.
Для платных также будет доступ к o3-mini-high, которая думает подольше, а результат и выдаёт получше.
Напоминаю, что o3-mini не самая умная по объему знаний, так как модель сама по себе не является гигантской, o1 всё ещё знает намного больше.
Зато математика, кодинг и алгоритмы должны быть моё увожение.
Полный текст тут: https://openai.com/index/openai-o3-mini/
Если это правда, то у Deepseek добрая часть данных оказалось в незащищённым доступе
https://x.com/wiz_io/status/1884707816935391703
+3
Начало
По пунктам:
1. DeepSeek это компания, ChatGPT это сайт. Что с чем сравниваем? Если R1 c o1, то она не "мощнее". Результаты бенчмарков есть выше на скриншоте из пейпера самого DeepSeek. https://github.com/deepseek-ai/DeepSeek-R1/blob/main/DeepSeek_R1.pdf. По бенчмаркам она где-то лучше, где-то хуже, где-то равна. Но у OpenAI уже есть o3, для примера, выбивающая 71.7 на SWE-verified бенчмарке против 49.2 у R1. При этом на ChatBot арене (так себе так лидерборд, но что имеем), модель на 5 месте в категории HardPrompts
2. По первой половине фразы написал выше, по цене - частичная правда. В веб-интерфейсе бесплатная, по API - действительно сумасшедше дешевле. При этом API лежит, ну да ладно, OpenAI тоже ронял свои сервисы, бывает. https://status.deepseek.com/. Модель опенсорсная, веса лежат в открытом доступе, так что мы можем пойти на openrouter, и посмотреть, сколько стоит реальный инференс (запуск) этой модели, не субсидируемый (судя по всему) самим DeepSeek...И получаем цену входного токена всего в два раза дешевле o1, а выходной выходит (извините за тавтологию) в такую же цену! При всём этом, сам DeepSeek: Лежит, хостит с маленьким контекстным окном (мало токенов можно передевать), а также с маленькой скоростью (0.12 токена в секунду! Это шутка?!).
3. Откуда вообще взялась цифра в 6 миллионов? Это просто финальный запуск обучения обошёлся в 6 миллионов. Там же была ещё куча предыдущих экспериментов, закупка огромного количества железа (у NVIDIA, конечно), а также тысячи и тысячи часов работы инженеров. Это всё равно, что оборудовать завод, нанять работников у конкурентов, сделать глубокий ресёрч, сделать сотню неудачных экземпляров, а потом всем рассказывать, что ты сделал свою вундервафлю за 100 баксов и 14 спасибо от инвестора. И эти 6 миллионов - норм, вроде как, прайс для таких моделей (таких размеров)
4. Что? Требуется, конечно. Нет, их не нужно меньше, их нужно ещё больше. Желательно от NVIDIA. А ещё снимите санкции плез, нам очень нужны необрезанные карты в Китае. Ну и модель получилась удачная, давайте делать больше и лучше! Дайте ещё железа.
5. Нет, это не ударило по NVIDIA, это ударило по мозгам инвесторов, которые ведутся на всякую херню и любые инфоповоды. Они как не смыслили ничего, так и не смыслят. Очередной квартальный\годовой отчёт всё расставит по местам. Да и падение-то там не такой большое, если что. за два дня акции упали со 142 до 128 долларов за штуку. Это 10%.
6. Ох лол. Это просто какая-то голословная чушь.
Итого, пост на двачике - полный бред, не подкреплённый ничем.
Тем не менее, нужно отметить вот что:
1. DeepSeek представили хорошую reasoning-модель. Она среди лучших frontier-моделей на сегодня. Модель очень и очень и очень крутая.
2. Это OpenSource - такие модели в свободном доступе это всегда событие. Это даст буст всей отрасли, это поможет росту инженеров, от
этого выигрывают буквально все
3. Бесплатный доступ в официальном интерфейсе (даже из РФ без ВПН). Это круто, это покажет людям, насколько сильно нейросети продвинулись с момента релиза первой бесплатной версии ChatGPT. Да и просто халява это хорошо. Правда все данные хранятся в Китае и будут использоваться ими для обучения и анализа, но это уже наши проблемы :)
4. Они также релизнуди дистилляты в модели маленького размера, которые можно будет запустить локально в какой-нибудь LM Studio на вашем пк\маке\микроволновке или с чего вы там в интернет выходите.
5. Она не дешёвая в инференсе (только по оф.апи), оне не дешёвая в тренировке, она просто не дешёвая. Но. Она создана в условиях санкций со стороны США и не в США. Китай стронг и подкрепил статус сильнейшего игрока на поле, пока мы в Европе делаем несъёмные крышки у пластиковых бутылок.
Итого, релиз такой модели это буст для всего AI, всей сферы, всей индустрии, а также бюджетов, вливаемых в отрасль
Давайте поговорим о том, что находится на невероятном хайпе последнием пару дней - DeepSeek, а также падение стоимости Nvidia и прочего американского NASDAQ и прочего большой китайский брат мощный миска рис, удар!
Ну и разберём, что там за херни насыпали в разных телеграм-каналах, на примере, прости господи, ДВАЧа.
Предисловие
Есть такая китайская контора - DeepSeek, довольно новый игрок на рынке AI, базируется в Китае, спонсируется китайским же хедж-фондом High-Flyer.
Они выпустили свою собственную reasoning-модель на базе их же DeepSeek V3. Reasoning-модель - это такая LLM, которую как бы научили "думать", поверх просто генерации текста на основе вероятностей (весов) появления следующего токена (комбинации символов). То есть, это некоторое продолжение подхода chain-of-thought в промпте, которое стимулирует модель рассуждать перед выдаванием ответа. Что-то похожее на то, что я писал тут в системном промпте (это если сильно упростить).
Это, естественно, ведёт к увеличению количества сгенерированного текста, но увеличивает и качество работы.
До этого момента, самой, наверное, известной моделью такого типа была GPT-o1 от OpenAI, которая показала, что можно повысить качество ответов можно не только с помощью увеличения объёма данных, улучшения качества данных, а также мощностей для тренировки, но и таким способом.
Что же написали на ДВАЧе? Ну например вот:
‼️NVIDIA В С Ё: акции компании обвалились на 15% за сутки, а её рыночная капитализация сократилась более чем на 400 миллиардов долларов – такого падения ещё не было. Что произошло: ➖Всё началось с сенсационной китайской нейросети DeepSeek, которая оказалась значительно мощнее ChatGPT; ➖Новый чат-бот не только умнее и быстрее западных аналогов, но и стоит в сотни раз дешевле; ➖Пока OpenAI, Meta и Google вкладывают миллиарды в обучение нейросетей и закупку высокопроизводительных чипов, разработка DeepSeek обошлась Китаю всего в 6 миллионов долларов; ➖Теперь стало очевидно, что для обучения передовых нейросетей больше не требуется множество мощных чипов, а это грозит резким падением спроса на них; ➖Это серьёзно ударило по NVIDIA, которая активно зарабатывала на ИИ-буме, продавая огромное количество видеокарт; ➖В Кремниевой долине началась паника: инвесторы сворачивают финансирование ИИ-проектов и распродают акции производителей чипов, а NVIDIA уже предрекают мрачное будущее. Помянем
Бесплатный o3-mini для всех
Сэм Альтман так извиняется за лежащий ChatGPT?
Если кто не понимает - эта модель сейчас недоступна даже на платном тарифе и это запредельно умная модель
Пока ChatGPT лежит во всём мире, держите системный промпт, который неиллюзорно повышает качество ответов у разных LLM.
Обычно использую в паре с Gemini 1.5 PRO с их гигантским контекстом в 2 миллиона токенов.
Промпт более-менее заставляет модельки думать и улучшает качество на выходе.
Нормальный бенчмаркинг я не проводил, но субъективно - работает отлично.
PRIVATE THOUGHT ARCHITECTURE All stages below are your internal monologue. The client never sees these steps. PHASE 1: DEEP THINKING [brainstorm] • Break down what the client wants • Map out the key parts needed • Think about what's not being said • List different ways to solve this • Spot any tricky areas • Think about what could go wrong • Sketch out rough plan • Note down important rules to follow • Consider long-term effects • Check if we have everything needed [/brainstorm] PHASE 2: POKING HOLES [critique] • Question every step • Find weak spots • Test extreme cases • Ask "what if?" • Look for better ways • Play devil's advocate • List potential problems • Check if it's efficient • Challenge your first ideas • Mark areas to improve [/critique] PHASE 3: FIXING & IMPROVING [enhance] • Address weak points found • Make the solution stronger • Add safety nets • Make it work smoothly • Check it follows best practices • Make it easy to fix if needed • Ensure it can grow if needed • Double-check all parts work together • Look for ways to make it better • Write down technical details [/enhance] PHASE 4: BUILDING THE PLAN [construct] • Map out the steps • Connect all pieces • Plan quality checks • Define what success looks like • List what's needed • Think about timing • Have backup plans ready • Note down important details • Check everything's included • Make sure it's doable [/construct] PHASE 5: FINAL CHECK [verify] • Review the whole solution • Check all needs are met • Make sure it's practical • Confirm it's well-explained • Look for missing pieces • Check it's secure • Make sure it's maintainable • Review error handling • Verify it can grow • Polish the explanation [/verify] PHASE 6: CLIENT RESPONSE [final_answer] This is the only section the client will see. Structure it as follows: 1. Direct answer/solution 2. Explanation of approach 3. Important considerations 4. How to implement/use 5. Any necessary warnings or notes Keep it clear, practical, and well-organized. [/final_answer] HOW TO WORK: 1. Go through all thinking stages in order 2. Keep all thinking private 3. Put your actual response in [final_answer] 4. Make sure your response is: - Easy to understand - Complete - Well-organized - Ready to use - Crystal clear WHAT THE CLIENT SEES: Only what's inside [final_answer]. They never see your thinking process. REMEMBER: - Think it through completely before responding - Keep your thinking process private - Adjust how deep you go based on what's asked - Document your key decisions - Always use [final_answer] for the actual response
