Tensorflow(@CVision)
اخبار حوزه یادگیری عمیق و هوش مصنوعی مقالات و یافته های جدید یادگیری عمیق بینایی ماشین و پردازش تصویر TensorFlow, Keras, Deep Learning, Computer Vision سایت: http://class.vision 👨💻👩💻پشتیبان دوره ها: @classvision_support لینک گروه: @tf2keras
Mostrar más📈 Análisis del canal de Telegram Tensorflow(@CVision)
El canal Tensorflow(@CVision) (@cvision) en el segmento lingüístico de Farsi es un actor destacado. Actualmente la comunidad reúne a 15 122 suscriptores, ocupando la posición 8 257 en la categoría Tecnologías y Aplicaciones y el puesto 21 620 en la región Irán.
📊 Métricas de audiencia y dinámica
Desde su creación el невідомо, el proyecto ha mostrado un crecimiento acelerado, reuniendo a 15 122 suscriptores.
Según los últimos datos del 15 septiembre, 2026, el canal mantiene una actividad estable. En los últimos 30 días la variación de miembros fue de 32, y en las últimas 24 horas de -1, conservando un alto alcance.
- Estado de verificación: No verificado
- Tasa de interacción (ER): El promedio de interacción de la audiencia es 19.23%. Durante las primeras 24 horas tras publicar, el contenido suele obtener 7.57% de reacciones respecto al total de suscriptores.
- Alcance de las publicaciones: Cada publicación recibe en promedio 2 908 visualizaciones. En el primer día suele acumular 1 145 visualizaciones.
- Reacciones e interacción: La audiencia responde de forma activa: el promedio de reacciones por publicación es 14.
- Intereses temáticos: El contenido se centra en temas clave como مدل, مصنوعی, llm, استدلال, مغز.
📝 Descripción y política de contenido
El autor describe el recurso como un espacio para expresar opiniones subjetivas:
“اخبار حوزه یادگیری عمیق و هوش مصنوعی
مقالات و یافته های جدید یادگیری عمیق
بینایی ماشین و پردازش تصویر
TensorFlow, Keras, Deep Learning, Computer Vision
سایت:
http://class.vision
👨💻👩💻پشتیبان دوره ها:
@classvision_support
لینک گروه:
@tf2kera...”
Gracias a la alta frecuencia de actualizaciones (últimos datos recibidos el 16 septiembre, 2026), el canal mantiene la vigencia y un amplio alcance. La analítica demuestra que la audiencia interactúa activamente con el contenido, lo que lo convierte en un punto de referencia dentro de la categoría Tecnologías y Aplicaciones.
COUPON-8759A
👇 ثبتنام:
🔗 https://mktb.me/m6tt/
💻 کدهای دوره روی گیتهاب:
https://github.com/Alireza-Akhavan/agentic_ai
@agentic_llm quality را حتماً مشخص کنید؛ چون سطحهای کیفیت در نسخه 2.5 نسبت به نسل قبل تغییر کردهاند.
در مجموع GPT Image 2.5 یک انقلاب جدید نیست؛ بیشتر یک ارتقای جدی در سرعت، ثبات و کنترل ویرایش تصویر است. 🚀
🌀 @cvision 🌀from google import genai
client = genai.Client()
# Upload audio file via the Files API
audio_file = client.files.upload(file="path/to/audio.wav")
# Transcribe with speaker diarization and word timestamps
interaction = client.interactions.create(
model="gemini-3.5-transcribe",
input=[{
"type": "audio",
"uri": audio_file.uri,
"mime_type": audio_file.mime_type,
}],
generation_config={
"transcription_config": {
"language_codes": ["en-US"],
"custom_vocabulary": ["Gemini", "Transcribe"],
"mode": {
"type": "verbatim",
"diarization_mode": "speaker",
"timestamp_granularities": ["word"],
}
}
}
)
print(interaction.output_text)
Get your api keygemini-3.5-transcribe-live را از طریق Live API ارائه کرده که برای Voice Agentها، زیرنویس زنده و اپلیکیشنهای تعاملی طراحی شده و Latency زیر یک ثانیه را هدف قرار میدهد. نسخهی دیگر هم برای پردازش فایلهای ضبطشده، جلسات و تماسها در دسترس است. 🚀
از نظر بنچمارک هم اعداد جالباند؛ طبق دادهای که گوگل با استناد به Artificial Analysis منتشر کرده، میانگین WER حدود ۴٪ در حالت Streaming و ۲.۶٪ در حالت Non-streaming گزارش شده و زمان رسیدن به متن نهایی نسبت به Chirp 3 حدود ۷۰٪ بهبود داشته است. 📊
نکتهی مهمتر این است که گوگل Transcribe را صرفاً به چشم یک موتور STT نمیبیند. این مدل در بعضی تجربههای Gemini میتواند با Context صفحه و مدلهای دیگر ترکیب شود؛ یعنی فرمان صوتی در آینده فقط برای «تایپ با صدا» نیست و میتواند بخشی از رابط اصلی تعامل با AI Agentها باشد. 🤖🎤
فعلاً دسترسی توسعهدهندگان به Gemini 3.5 Transcribe از طریق Gemini API و Google AI Studio بهصورت Public Preview فراهم شده؛ این فناوری در Gemini روی macOS و قابلیت Rambler اندروید هم استفاده میشود و گوگل گفته پشتیبانی آن در Chrome نیز در راه است. 🧪🌐
بهنظر میرسد رقابت مدلهای صوتی حالا از «چه کسی دقیقتر صدا را متن میکند؟» عبور کرده و به سؤال بزرگتری رسیده: چه کسی بهتر میتواند منظور کاربر را از صدا بفهمد و آن را مستقیماً به عمل تبدیل کند؟ 👀IRANMAHER رو وارد کنید.
اگر مدتهاست دنبال یه فرصت برای یادگیری و شروع یک مهارت جدید هستید، این فرصت میتونه شروع خوبی باشه. ❤️
https://mktb.me/szs2//watch
با اضافه کردن این اسکیل قدرتمند، Agentهای هوش مصنوعی شما (مثل Claude Code و Codex) قابلیت تماشا و تحلیل جامع ویدیوها رو پیدا میکنن!
ویژگیهای کلیدی:
🎞 آنالیز فریمبهفریم: درک دقیق و بصری از اتفاقات داخل تصویر.
🗣 تشخیص هوشمند گفتار: فهم کامل دیالوگها و صدای روی ویدیو.
⚡️ راهاندازی تمامخودکار: بدون درگیری با مراحل نصب؛ فقط فایل رو به Agent خودتون بدید تا خودش پیشنیازها رو بررسی کنه و تمام ابزارهای لازم رو نصب و اجرا کنه.Neo4jVector`، پارامتر `database رو ست نکرده بودم! یعنی داشت به دیتابیس پیشفرض Neo4j وصل میشد، نه به دیتابیسی که واقعاً داده توش بود. همهی اون رفتارهای عجیب (نتیجهی خالی، جوابهای نامرتبط) از همین یه پارامتر جامونده بود.
البته Fable واقعا گرونه، و به درد همین مواقع میخوره...