Tensorflow(@CVision)
اخبار حوزه یادگیری عمیق و هوش مصنوعی مقالات و یافته های جدید یادگیری عمیق بینایی ماشین و پردازش تصویر TensorFlow, Keras, Deep Learning, Computer Vision سایت: http://class.vision 👨💻👩💻پشتیبان دوره ها: @classvision_support لینک گروه: @tf2keras
Больше📈 Аналитический обзор Telegram-канала Tensorflow(@CVision)
Канал Tensorflow(@CVision) (@cvision) языкового сегмента Фарси является активным участником. Сейчас сообщество объединяет 15 122 подписчиков, занимая 8 257 место в категории Технологии и приложения и 21 620 место в регионе Иран.
📊 Показатели аудитории и динамика
С момента создания невідомо проект демонстрирует стремительный рост, собрав аудиторию из 15 122 подписчиков.
Согласно последним данным от 15 сентября, 2026, канал показывает стабильную активность. За последние 30 дней изменение числа участников составило 32, а за последние 24 часа — -1, при этом общий охват остаётся высоким.
- Статус верификации: Не верифицирован
- Уровень вовлечённости (ER): Средний показатель вовлечённости аудитории составляет 19.23%. В первые 24 часа после публикации контент обычно набирает 7.57% реакций от общего числа подписчиков.
- Охват публикаций: В среднем каждый пост получает 2 908 просмотров. В течение первых суток публикация набирает 1 145 просмотров.
- Реакции и взаимодействия: Аудитория активно поддерживает контент: среднее количество реакций на один пост — 14.
- Тематические интересы: Контент сосредоточен на ключевых темах, таких как مدل, مصنوعی, llm, استدلال, مغز.
📝 Описание и контентная политика
Автор описывает ресурс как площадку для выражения субъективного мнения:
“اخبار حوزه یادگیری عمیق و هوش مصنوعی
مقالات و یافته های جدید یادگیری عمیق
بینایی ماشین و پردازش تصویر
TensorFlow, Keras, Deep Learning, Computer Vision
سایت:
http://class.vision
👨💻👩💻پشتیبان دوره ها:
@classvision_support
لینک گروه:
@tf2kera...”
Благодаря высокой частоте обновлений (последние данные получены 16 сентября, 2026) канал поддерживает актуальность и высокий уровень охвата публикаций. Аналитика показывает, что аудитория активно взаимодействует с контентом, что делает его важной точкой влияния в категории Технологии и приложения.
COUPON-8759A
👇 ثبتنام:
🔗 https://mktb.me/m6tt/
💻 کدهای دوره روی گیتهاب:
https://github.com/Alireza-Akhavan/agentic_ai
@agentic_llm quality را حتماً مشخص کنید؛ چون سطحهای کیفیت در نسخه 2.5 نسبت به نسل قبل تغییر کردهاند.
در مجموع GPT Image 2.5 یک انقلاب جدید نیست؛ بیشتر یک ارتقای جدی در سرعت، ثبات و کنترل ویرایش تصویر است. 🚀
🌀 @cvision 🌀from google import genai
client = genai.Client()
# Upload audio file via the Files API
audio_file = client.files.upload(file="path/to/audio.wav")
# Transcribe with speaker diarization and word timestamps
interaction = client.interactions.create(
model="gemini-3.5-transcribe",
input=[{
"type": "audio",
"uri": audio_file.uri,
"mime_type": audio_file.mime_type,
}],
generation_config={
"transcription_config": {
"language_codes": ["en-US"],
"custom_vocabulary": ["Gemini", "Transcribe"],
"mode": {
"type": "verbatim",
"diarization_mode": "speaker",
"timestamp_granularities": ["word"],
}
}
}
)
print(interaction.output_text)
Get your api keygemini-3.5-transcribe-live را از طریق Live API ارائه کرده که برای Voice Agentها، زیرنویس زنده و اپلیکیشنهای تعاملی طراحی شده و Latency زیر یک ثانیه را هدف قرار میدهد. نسخهی دیگر هم برای پردازش فایلهای ضبطشده، جلسات و تماسها در دسترس است. 🚀
از نظر بنچمارک هم اعداد جالباند؛ طبق دادهای که گوگل با استناد به Artificial Analysis منتشر کرده، میانگین WER حدود ۴٪ در حالت Streaming و ۲.۶٪ در حالت Non-streaming گزارش شده و زمان رسیدن به متن نهایی نسبت به Chirp 3 حدود ۷۰٪ بهبود داشته است. 📊
نکتهی مهمتر این است که گوگل Transcribe را صرفاً به چشم یک موتور STT نمیبیند. این مدل در بعضی تجربههای Gemini میتواند با Context صفحه و مدلهای دیگر ترکیب شود؛ یعنی فرمان صوتی در آینده فقط برای «تایپ با صدا» نیست و میتواند بخشی از رابط اصلی تعامل با AI Agentها باشد. 🤖🎤
فعلاً دسترسی توسعهدهندگان به Gemini 3.5 Transcribe از طریق Gemini API و Google AI Studio بهصورت Public Preview فراهم شده؛ این فناوری در Gemini روی macOS و قابلیت Rambler اندروید هم استفاده میشود و گوگل گفته پشتیبانی آن در Chrome نیز در راه است. 🧪🌐
بهنظر میرسد رقابت مدلهای صوتی حالا از «چه کسی دقیقتر صدا را متن میکند؟» عبور کرده و به سؤال بزرگتری رسیده: چه کسی بهتر میتواند منظور کاربر را از صدا بفهمد و آن را مستقیماً به عمل تبدیل کند؟ 👀IRANMAHER رو وارد کنید.
اگر مدتهاست دنبال یه فرصت برای یادگیری و شروع یک مهارت جدید هستید، این فرصت میتونه شروع خوبی باشه. ❤️
https://mktb.me/szs2//watch
با اضافه کردن این اسکیل قدرتمند، Agentهای هوش مصنوعی شما (مثل Claude Code و Codex) قابلیت تماشا و تحلیل جامع ویدیوها رو پیدا میکنن!
ویژگیهای کلیدی:
🎞 آنالیز فریمبهفریم: درک دقیق و بصری از اتفاقات داخل تصویر.
🗣 تشخیص هوشمند گفتار: فهم کامل دیالوگها و صدای روی ویدیو.
⚡️ راهاندازی تمامخودکار: بدون درگیری با مراحل نصب؛ فقط فایل رو به Agent خودتون بدید تا خودش پیشنیازها رو بررسی کنه و تمام ابزارهای لازم رو نصب و اجرا کنه.Neo4jVector`، پارامتر `database رو ست نکرده بودم! یعنی داشت به دیتابیس پیشفرض Neo4j وصل میشد، نه به دیتابیسی که واقعاً داده توش بود. همهی اون رفتارهای عجیب (نتیجهی خالی، جوابهای نامرتبط) از همین یه پارامتر جامونده بود.
البته Fable واقعا گرونه، و به درد همین مواقع میخوره...