en
Feedback
щитпромптинг

щитпромптинг

Open in Telegram

про нейросети щитпостинг личный опыт, сервисы, ресерчи, рассуждения об индустрии

Show more
563
Subscribers
No data24 hours
-47 days
+3030 days
Posts Archive
кто этот macintash pajeet akshit

в целом нет вопросов почему джонни айв больше не в компании
в целом нет вопросов почему джонни айв больше не в компании

thanks God for transformer thus siri 2.0 теперь сири может посоветовать в удобном виде что-то хотя в идеале она могла бы этой
thanks God for transformer thus siri 2.0 теперь сири может посоветовать в удобном виде что-то хотя в идеале она могла бы этой хуйней заняться сама!!

Repost from Denis Sexy IT 🤖
Давно порываюсь вам написать про ТГ-сетки которые про ML-пишут и что им не стоит верить, вот пример ⬆︎ Чт
Давно порываюсь вам написать про ТГ-сетки которые про ML-пишут и что им не стоит верить, вот пример ⬆︎ Что на самом деле происходит с этой новой моделью Reflection-70B: 1. Пару дней твиттерский показал свою новую языковую 70B-модель которая с рекордами прошла все бенчмарки (по его утверждению это был файнтюн Llama 3.1 70b ) и что такая же 400b будет вот-вот 2. Модель начала вируситься, ее начали качать и оказалось, что она толком не работает потому что там внутри немного битый конфиг ее запуска (это если простыми словами) 3. Автор перезалил модель, сказал что все починил и все работает — но теперь оказалось что нужно использовать только специальный системный промпт чтобы она работала 4. Сообщество начало тестировать, разобрало модель по кусочкам и оказалось, что это файнтюн Llama 70b 3.0, а не 3.1. И причем не файнтюн модели целиком, а просто Lora-адаптер вмерженного в модель (тренируют кусочек модели который замещает часть модели) 5. Автор сказал, я вообще не помню что я там использовал — толи 3.0 толи 3.1, что такое Lora я не знаю, это не важно все — мы тут сейчас все заново поставим тренироваться, уже поставили точнее (зачем перетренивать модель которая по метрикам побила все бенчмарки пару дней назад мы не узнаем) 6. Параллельно с этим, появилась веб-версия этой модели о которой пишет Бекдор — и ее API дали сегодня протестировать сторонней организации, она неплохо справилась и подтвердила что результаты высокие (но модель доступна только по API) 7. Пару часов назад автор публикует новую версию модели Reflection 70b e3 и сразу пишет, что с ней что-то не так: «Веса залились, но мы все еще проверяем, чтобы убедиться, что они правильные, прежде чем мы собираемся закончить день» – зачем заливать модель до тестов? Ответа нет 8. Люди тестирующие веб версию Reflection 70b, обратили внимание, что она очень похожа на Sonnet 3.5 — буквально токен в токен отдает ответы такие же ответы <играет цирковая музыка, вы находитесь здесь> Буду держать вас в курсе нашей высокотехнологичной драмы – возможно, чел правда что-то натренил, но пока мы не знаем что. Ну и для нейронок лучше читать проверенные ML-каналы, сейчас такое время, что все экспертами в АИ стали (я даже не про свой, я их часто сюда репощу)

photo content

Такие олимпийские я бы смотрел

oopsie whoopsie 🤭

photo content

Admins be like

Слава богу нормальное использование genai - вайфа проследит чтобы пива было сколько надо

бля как охуенно https://www.youtube.com/watch?v=BgWtaUryTh0

??

нейросети люблю

Когда боливуд твой датасет

photo content