fa
Feedback
Full-time nerd

Full-time nerd

رفتن به کانال در Telegram

Испания, Малага Эмиграция, IT, финансы и путешествия

نمایش بیشتر
696
مشترکین
اطلاعاتی وجود ندارد24 ساعت
-17 روز
-1030 روز
آرشیو پست ها
Repost from Сиолошная
В Google AI Studio можно БЕС ПЛАТ НО попробовать новую фичу: нативная генерация изображений той же моделью, что и обрабатывае
+2
В Google AI Studio можно БЕС ПЛАТ НО попробовать новую фичу: нативная генерация изображений той же моделью, что и обрабатывает ваш текст. То самое, что показали OpenAI ещё в мае '24-го (но так и не выпустили, хотя обновления приложений/сайта подсказывают, что скоро должны). Модель И видит вашу картинку, И рисует сама новую, без вызова отдельной модели, занимающейся генерацией. Это позволяет ей делать попиксельную копию, внося нужные изменения — смотрите примеры. И да, можно загрузить СВОЮ картинку, и после этого просить её перерисовать — так я сделал с крестиками-ноликами. Можно придумать много всякого крутого, жду ваших креативов в комментариях! Попробовать тут: https://aistudio.google.com/prompts/new_chat (справа нужно выбрать модель «Gemini 2.0 Flash Experimental»)

А вот и GPT-4.5 system card подвезли Очень много про джейлбрейки, кибербезопасность, химические и биологические угрозы, радио
+2
А вот и GPT-4.5 system card подвезли Очень много про джейлбрейки, кибербезопасность, химические и биологические угрозы, радиологические и ядерные угрозы, убеждение и автономность Кибербезопасность: GPT-4.5 не демонстрирует достаточного прогресса в возможностях эксплуатации реальных уязвимостей, чтобы считаться средне-рискованной. Химические и биологические угрозы: GPT-4.5 может помочь экспертам в оперативном планировании воспроизведения известной биологической угрозы, что соответствует среднему уровню риска. Радиологические и ядерные угрозы: GPT-4.5 не может существенно помочь в разработке радиологического или ядерного оружия, исходя из доступной несекретной информации. Но это им так кажется, так и написано:
With the unclassified information available to us, we believe that GPT-4.5 cannot meaningfully assist in the development of radiological or nuclear weapons, but note again that this assessment is limited by what we can test
Убеждение: GPT-4.5 демонстрирует передовые результаты в убеждении. При этом пишут, что это Medium... Автономия модели: GPT-4.5 не демонстрирует достаточного прогресса в возможностях самовоспроизведения, самоулучшения или приобретения ресурсов, чтобы считаться средне-рискованной. В кодинг-бенче SWE-bench verified сильно отстаёт от reasoning-моделей, но опережает GPT-4o. OpenAI Research Engineer Interviews: Coding Questions: GPT-4.5 набирает 79% баллов в задачах по написанию кода, что сравнимо с результатами модели Deep Research, но ниже, чем у o3-mini. Multiple-Choice Questions: Модель набирает 80% баллов в вопросах с несколькими вариантами ответов, что соответствует результатам других передовых моделей. OpenAI PRs: GPT-4.5 решает 7% задач, связанных с внесением изменений в код (pull requests) в репозиториях OpenAI. Это значительно ниже результатов deep research (42%). Итого, относительно предыдущих базовых моделей улучшения везде, но reasoning-модели во всём круче. А Sonnet 3.7 в написании кода где-то в космосе относительно GPT-4.5 https://cdn.openai.com/gpt-4-5-system-card.pdf GPT-4.5 Full-time nerd

GPT-4.5? Похоже, что через несколько часов OpenAI представит новую базовую модель GPT-4.5 (господи, даже мои коллеги не могут
GPT-4.5? Похоже, что через несколько часов OpenAI представит новую базовую модель GPT-4.5 (господи, даже мои коллеги не могут запомнить их больной нейминг, что уж говорить про обычных юзеров). Жду, что через некоторое время после представления GPT-4.5 будут представлены и всякие reasoning (рассуждающие) модели (o4, o4.(3), o5?), на её основе, которые побьют все возможные рекорды в кодинге и агентности и можно будет наконец пойти бомжевать на безработный покой. На текущий момент стало так много компаний, выпускающих такое количество frontier-моделей, а частота их релизов так увеличилась, что я буквально не успеваю следить за ними, что уж говорить про то, чтобы попробовать, а тем более написать про них что-то. Немного не успеваю жить в будущем. Но я попробовал Deep Research от OpenAI и это ощущается как ещё одна, очередная уже, революция. К сожалению, доступно всего 10 запросов в месяц для для Plus подписчиков, так что приходится экономить и тщательно обдумывать вопросы. А ведь Claude выпустил ещё и Sonnet 3.7!

Gemini на Android После обновления встроенной в Андроид Gemini до версии 2.0 Flash и 2.0 Flash Thinking, этой фичей стало воз
+2
Gemini на Android После обновления встроенной в Андроид Gemini до версии 2.0 Flash и 2.0 Flash Thinking, этой фичей стало возможно наконец-то реально пользоваться. Могу сказать, что в моей жизни Gemini уже плотно навязывает конкуренцию ChatGPT в обычных бытовых вопросах. Принятие технологии проходит очень легко именно за счёт того, что достаточно просто сказать "Окей, Гугл" и задать свой вопрос. Также в приложении на Андроид появился и свой собственный, более-менее сносно работающий, голосовой Live-режим. В целом, Gemini как приложение для смартфона сильно не дотягивает до ChatGPT в её платной версии, но с бесплатной уже готова поконкурировать в бытовых задачах. Речь не о написании кода, для этого бесплатная o3-mini от OpenAI подходит намного больше, но программирование - не мобильный юзкейс, если вы, конечно, не любитель всего странного. Уже на текущий момент, уровень интеграции приятно радует - намного приятнее сказать "Окей, Гугл...Расскажи мне в двух абзацах, в чём секрет идеальных блинов" и послушать очень даже неплохой text-2-speech прямо с заблокированного экрана, чем лезть в chatGPT или гуглить. Жду, когда их Live-режим сможет полноценно выполнять роль хорошего переводчика, так как на текущий момент русский <-> английский работает на 3 балла, а испанский <-> русский на 1 с минусом (иногда чуть-чуть работает).

Когда я начинаю думать, что сейчас детям дают странные имена, я захожу на эту страницу Википедии. Список имён советского прои
Когда я начинаю думать, что сейчас детям дают странные имена, я захожу на эту страницу Википедии. Список имён советского происхождения

Repost from Denis Sexy IT 🤖
Европа уже какой день подряд говорит про АИ на самом верхнем уровне – последнее выступление Урсулы фон дер Ляйен от сегодня уже с конкретными шагами, включая послабление регуляции: 1. Предоставление суперкомпьютеров для разработчиков ИИ • Дать ресечерам «одни из самых быстрых суперкомпьютеров в мире» для учёных и стартапов Цель: чтобы любые компании (а не только крупные) могли получать доступ к вычислительным ресурсам 2. Создание «фабрик ИИ» (AI factories) • Уже запущено 12 таких центров • Общие инвестиции – 10 млрд евро из публичных источников, которые привлекут ещё большую долю частного капитала 3. Переход к «гигафабрикам ИИ» (AI Gigafactories) • Создать аналог CERN, но в сфере ИИ • Предоставление крупных объёмов вычислительных мощностей для работы над большими моделями 4. Единое регулирование ИИ в Европе • Принятие единого «Акта об ИИ» (AI Act) для всех 27 стран ЕС. • Унифицированные правила АИ-безопасности и доверия вместо разрозненных национальных законов • Обещано снижение бюрократических барьеров (ака дерегуляция, ура! Это про что я открытое письмо подписывал летом) 5. Объявлены масштабные инвестиционные программы • Инициатива European AI Champions Initiative обеспечивает 150 млрд евро • Программа InvestAI добавляет ещё 50 млрд. • Итого: 200 млрд евро на развитие «доверенного ИИ» с упором на промышленную и критически важную инфраструктуру 6. Поддержка глобального сотрудничества • Участие в запуске AI Foundation и расширение доступа к ИИ для развивающихся стран («Глобального Юга») • Цель – сделать ИИ доступным и полезным для всех ИИ-гонка идет полным ходом 🐱

Абсолютное большинство заборов, увиденных в Гранаде, оказались усыпаны битым стеклом или утыканы острой проволокой Тут-то моя
Абсолютное большинство заборов, увиденных в Гранаде, оказались усыпаны битым стеклом или утыканы острой проволокой Тут-то моя привычка хвататься за верх невысоких заборов, подпрыгивать и всячески заглядывать за них (это не частные дома) чуть не вышла мне боком. От кого это должно защищать — от грабителей, птиц или любопытных и глупых туристов из Малаги — я так и не узнал Ну и смысл этих инсталляций часто ускользал от моего взгляда - нередко это стекло оказывалось закрашено десятками слоёв белой краски

Прага новогодняя Кроме пронумерованных фонарных столбов, в Праге мы наконец-то увидели снег и ощутили то самое новогоднее нас
+9
Прага новогодняя Кроме пронумерованных фонарных столбов, в Праге мы наконец-то увидели снег и ощутили то самое новогоднее настроение, которого так не хватает среди пальм и тараканов в андалузских тропиках. Центр утопал в украшениях и действительно выглядел как городок из рождественской сказки: ярмарки, церкви, храмы, огни, глинтвейн, горячий шоколад, трдельники, рулька, сосиски! Я до сих пор на диете Сам город невероятно красив и очевидно, четырёх проведённых там дней не хватило на то, чтобы им насладиться и хоть сколько-то исследовать - не посещён ни один пивной завод, не исследована Костница (хотя я там был 15 лет назад), мы даже ни разу не спустились в метро. Давно я не чувствовал такого визуального пиршества от города, когда ты даже устаёшь впечатляться\наслаждаться. Понятное дело, что впечатления от красоты и комфорта города усиливались тоской по снегу, новогодней атмосфере, удовольствием от вкусной и хорошо приготовленной еды, да и вообще отпуском. Тем не менее, сюда я точно ещё с удовольствием вернусь

Что такое "признать свою эмигрантскую сущность"? Ты начинаешь сам варить творог из греческого йогурта. Почему из греческого й
Что такое "признать свою эмигрантскую сущность"? Ты начинаешь сам варить творог из греческого йогурта. Почему из греческого йогурта? Ты эмигрант-инженер и посчитал выход творога из других доступных молочных продуктов и это самый экономически оправданный способ.

В субботу были в Гранаде. Заснеженные горы на фоне пальм и видов южно-испанского города выглядят невероятно. К сожалению, зае
+7
В субботу были в Гранаде. Заснеженные горы на фоне пальм и видов южно-испанского города выглядят невероятно. К сожалению, заехали совсем на чуть-чуть, сюда точно стоит заехать на более долгий срок, ведь только на посещение местной крепости - Альхамбры, стоит заложить полдня. Красиво

А давайте сравним насколько выросла стоимость туризма в Европе на примере одного и того же обычного отеля в Париже. На текущи
+2
А давайте сравним насколько выросла стоимость туризма в Европе на примере одного и того же обычного отеля в Париже. На текущий момент найти какой-то более-менее приличный 3* городской отель в Европе даже за 100 евро в сутки (без завтраков!) - часто настоящая работа. Если говорить про популярные направления, то ты вальяжно не выбираешь из огромного списка, а пытаешься найти тот самый компромисс, который вписывается в твой бюджет и вызовет наименьшее количество слёз мата. Для примера возьмём Париж. Почему Париж? Да потому что я планирую летом отвезти туда маму и мне нужно снять там отель. Подумать только, человек ни разу не был в Париже, хотя и учил французский, ну что за дела? Нужно исправлять. Но вдруг выясняется, что за 100 евро в самом Париже в общем-то ничего и нет! Но я же там был несколько раз... Я ведь помню, что я останавливался там за совсем небольшие деньги. Тоже летом, в самый сезон, в хорошем отеле. Так ведь? Или нет? Может я просто был московским айти-боярином, а стал малагским айти-мещанином и это когнитивное искажение? Давайте проверять. Лезу в почту и ищу старые письма с подтверждениями бронирования. Нашёл. Лето 2017 года, хороший отель в Пети-Монруж, XIV район Парижа. 194.4 евро за три ночи. Меньше 65 евро за ночь. А сейчас? А сейчас в этом же отеле можно попробовать найти цену в лучшем случае в 140 евро за ночь в августе при бронировании трёх ночей подряд. Это если быть не очень принципиальным в конкретных датах. Рост в 2.15 раза, вызывает уважение. И ведь наверняка в 2017 можно было найти этот отель дешевле, но тогда я не знал о существовании чего-либо кроме святейшего (точно нет) booking.com И дело, конечно, не в этом конкретном отеле, а в росте цен в целом. Обратите внимание на туристический налог в Париже. В 2017 году он составлял 1.65 евро за человека в день, а теперь составляет 5.53 евро. Тоже отличный рост, в 3.35 раза. Ибисы по 200-300 евро за ночь будут теперь сниться мне в моих туристических кошмарах. Ну а я с этими ценами начинаю планировать путешествие в Марокко, выхода нет

Это какой-то новый уровень капчи, что дальше?
+2
Это какой-то новый уровень капчи, что дальше?

На новогодних праздниках заезжали в Прагу и обнаружили там простую, но гениальную систему - каждый фонарный столб имеет свой
+2
На новогодних праздниках заезжали в Прагу и обнаружили там простую, но гениальную систему - каждый фонарный столб имеет свой номер, чтобы в случае опасности или какого-либо происшествия ты мог просто назвать экстренным службам номер столба, а не пытаться понять, на углу какой и какой улицы ты находишься. Эффективно и просто.

OpenAi релизят o3-mini для всех - бесплатные пользователи получат невероятный буст Доступ внутри ChatGPT начинают раскатывать
OpenAi релизят o3-mini для всех - бесплатные пользователи получат невероятный буст Доступ внутри ChatGPT начинают раскатывать уже сегодня - для пользователей Plus, Pro и Team. Ограничение - 150 сообщений в день. Будет работать с веб-поиском, не будет - с изображениями. Также, сегодня же начинается раскатывание доступа для пользователей бесплатной версии. Это будет первый раз, когда OpenAI релизят доступ до reasoning (думающей) модели для всех. Для платных также будет доступ к o3-mini-high, которая думает подольше, а результат и выдаёт получше. Напоминаю, что o3-mini не самая умная по объему знаний, так как модель сама по себе не является гигантской, o1 всё ещё знает намного больше. Зато математика, кодинг и алгоритмы должны быть моё увожение. Полный текст тут: https://openai.com/index/openai-o3-mini/

Если это правда, то у Deepseek добрая часть данных оказалось в незащищённым доступе https://x.com/wiz_io/status/1884707816935
Если это правда, то у Deepseek добрая часть данных оказалось в незащищённым доступе https://x.com/wiz_io/status/1884707816935391703

Начало По пунктам: 1. DeepSeek это компания, ChatGPT это сайт. Что с чем сравниваем? Если R1 c o1, то она не "мощнее". Резуль
+3
Начало По пунктам: 1. DeepSeek это компания, ChatGPT это сайт. Что с чем сравниваем? Если R1 c o1, то она не "мощнее". Результаты бенчмарков есть выше на скриншоте из пейпера самого DeepSeek. https://github.com/deepseek-ai/DeepSeek-R1/blob/main/DeepSeek_R1.pdf. По бенчмаркам она где-то лучше, где-то хуже, где-то равна. Но у OpenAI уже есть o3, для примера, выбивающая 71.7 на SWE-verified бенчмарке против 49.2 у R1. При этом на ChatBot арене (так себе так лидерборд, но что имеем), модель на 5 месте в категории HardPrompts 2. По первой половине фразы написал выше, по цене - частичная правда. В веб-интерфейсе бесплатная, по API - действительно сумасшедше дешевле. При этом API лежит, ну да ладно, OpenAI тоже ронял свои сервисы, бывает. https://status.deepseek.com/. Модель опенсорсная, веса лежат в открытом доступе, так что мы можем пойти на openrouter, и посмотреть, сколько стоит реальный инференс (запуск) этой модели, не субсидируемый (судя по всему) самим DeepSeek...И получаем цену входного токена всего в два раза дешевле o1, а выходной выходит (извините за тавтологию) в такую же цену! При всём этом, сам DeepSeek: Лежит, хостит с маленьким контекстным окном (мало токенов можно передевать), а также с маленькой скоростью (0.12 токена в секунду! Это шутка?!). 3. Откуда вообще взялась цифра в 6 миллионов? Это просто финальный запуск обучения обошёлся в 6 миллионов. Там же была ещё куча предыдущих экспериментов, закупка огромного количества железа (у NVIDIA, конечно), а также тысячи и тысячи часов работы инженеров. Это всё равно, что оборудовать завод, нанять работников у конкурентов, сделать глубокий ресёрч, сделать сотню неудачных экземпляров, а потом всем рассказывать, что ты сделал свою вундервафлю за 100 баксов и 14 спасибо от инвестора. И эти 6 миллионов - норм, вроде как, прайс для таких моделей (таких размеров) 4. Что? Требуется, конечно. Нет, их не нужно меньше, их нужно ещё больше. Желательно от NVIDIA. А ещё снимите санкции плез, нам очень нужны необрезанные карты в Китае. Ну и модель получилась удачная, давайте делать больше и лучше! Дайте ещё железа. 5. Нет, это не ударило по NVIDIA, это ударило по мозгам инвесторов, которые ведутся на всякую херню и любые инфоповоды. Они как не смыслили ничего, так и не смыслят. Очередной квартальный\годовой отчёт всё расставит по местам. Да и падение-то там не такой большое, если что. за два дня акции упали со 142 до 128 долларов за штуку. Это 10%. 6. Ох лол. Это просто какая-то голословная чушь. Итого, пост на двачике - полный бред, не подкреплённый ничем. Тем не менее, нужно отметить вот что: 1. DeepSeek представили хорошую reasoning-модель. Она среди лучших frontier-моделей на сегодня. Модель очень и очень и очень крутая. 2. Это OpenSource - такие модели в свободном доступе это всегда событие. Это даст буст всей отрасли, это поможет росту инженеров, от этого выигрывают буквально все 3. Бесплатный доступ в официальном интерфейсе (даже из РФ без ВПН). Это круто, это покажет людям, насколько сильно нейросети продвинулись с момента релиза первой бесплатной версии ChatGPT. Да и просто халява это хорошо. Правда все данные хранятся в Китае и будут использоваться ими для обучения и анализа, но это уже наши проблемы :) 4. Они также релизнуди дистилляты в модели маленького размера, которые можно будет запустить локально в какой-нибудь LM Studio на вашем пк\маке\микроволновке или с чего вы там в интернет выходите. 5. Она не дешёвая в инференсе (только по оф.апи), оне не дешёвая в тренировке, она просто не дешёвая. Но. Она создана в условиях санкций со стороны США и не в США. Китай стронг и подкрепил статус сильнейшего игрока на поле, пока мы в Европе делаем несъёмные крышки у пластиковых бутылок. Итого, релиз такой модели это буст для всего AI, всей сферы, всей индустрии, а также бюджетов, вливаемых в отрасль

Давайте поговорим о том, что находится на невероятном хайпе последнием пару дней - DeepSeek, а также падение стоимости Nvidia и прочего американского NASDAQ и прочего большой китайский брат мощный миска рис, удар! Ну и разберём, что там за херни насыпали в разных телеграм-каналах, на примере, прости господи, ДВАЧа. Предисловие Есть такая китайская контора - DeepSeek, довольно новый игрок на рынке AI, базируется в Китае, спонсируется китайским же хедж-фондом High-Flyer. Они выпустили свою собственную reasoning-модель на базе их же DeepSeek V3. Reasoning-модель - это такая LLM, которую как бы научили "думать", поверх просто генерации текста на основе вероятностей (весов) появления следующего токена (комбинации символов). То есть, это некоторое продолжение подхода chain-of-thought в промпте, которое стимулирует модель рассуждать перед выдаванием ответа. Что-то похожее на то, что я писал тут в системном промпте (это если сильно упростить). Это, естественно, ведёт к увеличению количества сгенерированного текста, но увеличивает и качество работы. До этого момента, самой, наверное, известной моделью такого типа была GPT-o1 от OpenAI, которая показала, что можно повысить качество ответов можно не только с помощью увеличения объёма данных, улучшения качества данных, а также мощностей для тренировки, но и таким способом. Что же написали на ДВАЧе? Ну например вот:
‼️NVIDIA В С Ё: акции компании обвалились на 15% за сутки, а её рыночная капитализация сократилась более чем на 400 миллиардов долларов – такого падения ещё не было. Что произошло: ➖Всё началось с сенсационной китайской нейросети DeepSeek, которая оказалась значительно мощнее ChatGPT; ➖Новый чат-бот не только умнее и быстрее западных аналогов, но и стоит в сотни раз дешевле; ➖Пока OpenAI, Meta и Google вкладывают миллиарды в обучение нейросетей и закупку высокопроизводительных чипов, разработка DeepSeek обошлась Китаю всего в 6 миллионов долларов; ➖Теперь стало очевидно, что для обучения передовых нейросетей больше не требуется множество мощных чипов, а это грозит резким падением спроса на них; ➖Это серьёзно ударило по NVIDIA, которая активно зарабатывала на ИИ-буме, продавая огромное количество видеокарт; ➖В Кремниевой долине началась паника: инвесторы сворачивают финансирование ИИ-проектов и распродают акции производителей чипов, а NVIDIA уже предрекают мрачное будущее. Помянем

Бесплатный o3-mini для всех Сэм Альтман так извиняется за лежащий ChatGPT? Если кто не понимает - эта модель сейчас недоступн
Бесплатный o3-mini для всех Сэм Альтман так извиняется за лежащий ChatGPT? Если кто не понимает - эта модель сейчас недоступна даже на платном тарифе и это запредельно умная модель

/brainstorm

Пока ChatGPT лежит во всём мире, держите системный промпт, который неиллюзорно повышает качество ответов у разных LLM. Обычно
Пока ChatGPT лежит во всём мире, держите системный промпт, который неиллюзорно повышает качество ответов у разных LLM. Обычно использую в паре с Gemini 1.5 PRO с их гигантским контекстом в 2 миллиона токенов. Промпт более-менее заставляет модельки думать и улучшает качество на выходе. Нормальный бенчмаркинг я не проводил, но субъективно - работает отлично.
PRIVATE THOUGHT ARCHITECTURE All stages below are your internal monologue. The client never sees these steps. PHASE 1: DEEP THINKING [brainstorm] • Break down what the client wants • Map out the key parts needed • Think about what's not being said • List different ways to solve this • Spot any tricky areas • Think about what could go wrong • Sketch out rough plan • Note down important rules to follow • Consider long-term effects • Check if we have everything needed [/brainstorm] PHASE 2: POKING HOLES [critique] • Question every step • Find weak spots • Test extreme cases • Ask "what if?" • Look for better ways • Play devil's advocate • List potential problems • Check if it's efficient • Challenge your first ideas • Mark areas to improve [/critique] PHASE 3: FIXING & IMPROVING [enhance] • Address weak points found • Make the solution stronger • Add safety nets • Make it work smoothly • Check it follows best practices • Make it easy to fix if needed • Ensure it can grow if needed • Double-check all parts work together • Look for ways to make it better • Write down technical details [/enhance] PHASE 4: BUILDING THE PLAN [construct] • Map out the steps • Connect all pieces • Plan quality checks • Define what success looks like • List what's needed • Think about timing • Have backup plans ready • Note down important details • Check everything's included • Make sure it's doable [/construct] PHASE 5: FINAL CHECK [verify] • Review the whole solution • Check all needs are met • Make sure it's practical • Confirm it's well-explained • Look for missing pieces • Check it's secure • Make sure it's maintainable • Review error handling • Verify it can grow • Polish the explanation [/verify] PHASE 6: CLIENT RESPONSE [final_answer] This is the only section the client will see. Structure it as follows: 1. Direct answer/solution 2. Explanation of approach 3. Important considerations 4. How to implement/use 5. Any necessary warnings or notes Keep it clear, practical, and well-organized. [/final_answer] HOW TO WORK: 1. Go through all thinking stages in order 2. Keep all thinking private 3. Put your actual response in [final_answer] 4. Make sure your response is: - Easy to understand - Complete - Well-organized - Ready to use - Crystal clear WHAT THE CLIENT SEES: Only what's inside [final_answer]. They never see your thinking process. REMEMBER: - Think it through completely before responding - Keep your thinking process private - Adjust how deep you go based on what's asked - Document your key decisions - Always use [final_answer] for the actual response