Вайбкодер вайбкодеру
Ir al canal en Telegram
Мой канал, тут и новости в сфере ИИ и просто какие-то мои посты.
Mostrar másEl país no está especificadoLa categoría no está especificada
2 340
Suscriptores
+1224 horas
+2027 días
+52930 días
Archivo de publicaciones
2 338
👀 Тибо (руководитель Codex в OpenAI) обещал ресет на вторник.
Правда какой вторник он не упомянул.
2 338
🇨🇳 Китай снова в игре: Xiaomi ночью выпустила MiMo-V2.6 Pro и Flash и результаты очень сильные.
Xiaomi потратила всего 130 часов, 75 млрд токенов и $2,6 млн на RL, чтобы вывести MiMo-V2.6 Pro на первое место среди открытых моделей. И у них получилось! 🫣AA Intelligence Index — 46,32 (выше Kimi K3 и Qwen3.8 Max) При этом цена за 1 млн токенов осталась такой же, как у V2.5.
• MiMo-V2.6 Pro — $0.435 / $0.87 • MiMo-V2.6 Flash — $0.14 / $0.28, примерно треть цены Pro • DeepSeek V4 Pro — около $0.66–1.32 / $1.98–3.96, Pro дешевле примерно в 2–5 раз • GLM-5.3 — около $1.40 / $4.40, Pro дешевле примерно в 3–5 раз • Qwen3.8 Max — около $2 / $6, Pro дешевле примерно в 5–7 раз • Gemini 3.5 Flash — около $1.50 / $9, Pro дешевле примерно в 3–10 раз • Gemini 3.1 Pro — около $2 / $12, Pro дешевле примерно в 5–14 раз • GPT-5.6 Sol — около $4–5 / $20, Pro дешевле примерно в 10–23 раза • Claude Opus 5 — около $5 / $25, Pro дешевле примерно в 12–29 раз • Claude Fable 5 — около $10 / $50, Pro дешевле примерно в 23–58 разОдна задача обходится примерно в $0.13.
↪️ Весь процесс обучения транслировался в реальном времени, а расходы и сбои публиковались онлайн 🥳. Вместе с моделью открыты веса, код RL и среды.Это вам не Muse Spark)))
2 338
Codex начал сейфгуардить за легальные код-задачи: написать простое MCP для 1 сайта 🥶
Классно, спасибо! Если я потеряю свой х20 из-за этого я убью руководителя опенаи
2 338
Кажется, тот самый «пузырь» скоро лопнет. Ну сеоьезно, тут все логично: OpenAI нерфит почти все, люди после лимитов идут к конкурентам. Нагрузка переходит к ним, Claude начинается капаситься (уже было). И так по кругу.
Как это можно исправить?
OpenAI нужно просто закинуть еще пару лесятков миллиардов долларов на сервера.
2 338
⚠️ xAI официально представили Grok 4.7!
🚪 Илон Маск и команда дропнули новую флагманскую модель на целых 2,1 триллиона параметров. Сделали упор на расширенный RL под долгие и сложные многочасовые таски.
🔼 Что завезли в обновлении: • Базовая архитектура на 2,1 трлн параметров с акцентом на сложные пайплайны. • На CursorBench 4.0 набрала 46,3% против 40,4% у Grok 4.6, а на DeepSWE v1.1 — 71% против 65,2%. • Новый защитный стек — повышенная устойчивость к джейлбрейкам и фокус на безопасность в кибернетике. • Сильно улучшили самопроверку и стабильность при работе с гигантским контекстом.📈 По ценам в API: • $2 за вход на 1 млн токенов, $6 за выход соответственно. • Выход: $6 за 1 млн токенов. Модель уже доступна сразу в Cursor, Grok Build, через облака и по API.
2 338
↪️ OpenCode Zen отрубила бесплатное API...
Раньше можно было использовать ту же Muse Spark 1.3 или Nemotron 3 Ultra (бесплатные модели) через API, но сегодня я узнал что они это прикрыли.
⚠️ Все модели на бесплатном аккаунте стали отдавать: free tier can only be used from within OpenCode.Обошёл я это достаточно легко, через ту же Muse Spark 1.3 в опенкоде пореверсил запросы опенкода, скопировал всю инфу из хедера и сэмулировал клиент опенкода. 1 час работы.
2 338
↪️ Я сейчас пишу чекер аккаунтов для Cry Base и он уже готов под 15+ читов. Будет ли полезно если я разверну публичное API с маленькими ценами для того чтобы чекать аккаунты? После доделывания чекер будет под 40+ читов.
2 338
⚠️ OpenAI умирает... А точнее, их модели. Они не справляются с нагрузкой. Почему?
1 — модели GPT 5.6 Sol очень часто в capacity (перегружены) 2 — GPT 6 Astra была сильно понерфена (не только по бенчмаркам) 3 — недельные лимиты на подписках Pro (x20) были сильно укорочены. За простые задачи в 40 минут я трачу по 1-2%, а раньше максимум 1% или вообще не 1.
