مرجع دیتاست فارسی
رفتن به کانال در Telegram
لطفا برای معرفی و درج دیتاست خود داخل کانال به @data_hub پیام دهید.
نمایش بیشتر3 085
مشترکین
اطلاعاتی وجود ندارد24 ساعت
+127 روز
+4030 روز
آرشیو پست ها
3 085
📚 تاحالا شده بخوای پایتون رو از منبع رسمی و اصلی یادبگیری ولی توی زبان انگلیسیش گیر کنی؟
مستندات فایل python-docs کامل به فارسی ترجمه شده
چی بهتر از این؟!؟
از این رسمی تر و معتبر تر منبع ترجمه شده نداریم
اگه میخوای از مستندات استفاده کنی یا حتی توی ترجمهها مشارکت داشته باشی، میتونی راحت اینجا رو بررسی کنی.
روی لینک بزن و مستقیم برو سراغش:
👉 github.com/Revisto/python-docs-fa
3 085
Repost from دیتاهاب
سلام رفقا 💙
برای همهی کسایی که میخوان وارد دنیای هوش مصنوعی بشن و هنوز حس میکنن که ریاضی یه مانع جدی تو مسیرشونه، این وبینار دقیقاً برای شما طراحی شده!
وبینار ما نه فقط یه جلسه تئوری بلکه یه راهنمای واقعی برای شروع یادگیری بدون استرس و پیچیدگی هست.
🗓 زمان وبینار: سهشنبه ۱۶ اردیبهشت | ساعت ۱۸:۰۰ تا ۱۹:۰۰
📍 برگزاری آنلاین
🎁 برای شما که عضو کامیونیتی دیتاهاب هستید، یه کد تخفیف ویژه داریم:
community1 → فقط ۵۰ هزار تومان! (ظرفیت محدود)
🔗 لینک ثبتنام:
https://ttr.ir/2su1wn3 085
Repost from دیتاهاب
یه قدم واقعی برای خودت و آیندهت🩵
هوش مصنوعی مسیر جذابیه، ولی اگه ریاضی رو جدی نگیری، زود خسته میشی...
نه که بترسونیمت، ولی خودمونم دیدیم خیلیها اینجا کم میارن.
نه با سختگیری، نه با فرمولهای عجیب، فقط با یه راه درست.
⚙️ این وبینار رو برای خودمون و آدمهایی مثل خودمون ساختیم:
کسانی که نمیخوان سرسری یاد بگیرن، دنبال مسیر واقعی هستن، و دوست دارن بدون ترس و شلوغبازی شروع کنن.
🎙 با مهندس مبشری یاد میگیریم:
✅ چرا ریاضی برای موفقیت توی پروژههای AI مهمه
✅ چی باید بلد باشی که واقعا جلو بیفتی، نه اینکه فقط ظاهر قضیه رو بدونی
✅ چطوری بدون استرس، یه مسیر یادگیری کاربردی بچینی
🗓 زمان: سه شنبه ۱۶ اردیبهشت | 🔜 ساعت: ۱۸:۰۰ تا ۱۹:۰۰
😀 برگزاری: آنلاین
🔴 اگه میخوای با خیال راحت قدم برداری اینجا ثبتنام کن:
🔗 ثبتنام وبینار
🎁 کدهای تخفیف مخصوص بچههای دیتاهاب:
🛍 کد
community1 → ۷۲٪ تخفیف (ظرفیت خیلی محدود)
🛍 کد community2 → ۲۲٪ تخفیف (ظرفیت محدود)
😀 حواست باشه مخصوص کامیونیتی خودمونه.
😀 هر سوالی داشتی، بیتعارف همینجا ازمون بپرس. ما اینجاییم که مسیرت رو روشنتر کنیم، نه اینکه از دور نگاهت کنیم.
ثبت نام:
https://ttr.ir/2su1wn
با هم قویتر میشیم. 🚀3 085
یک گنجینه بینظیر از دیتاستهای فارسی برای تحقیقات و پروژههای مختلف! این مخزن شامل مجموعههای متنوعی از دادههای متنی، صوتی و تصویری است که بهویژه برای پروژههای پردازش زبان طبیعی، یادگیری ماشین و بینایی کامپیوتری کاربرد دارد. با استفاده از این دیتاستها میتوانید مدلهای خود را بر روی دادههای واقعی فارسی به خوبی آموزش دهید و نتایج بهتری کسب کنید.
📱 GitHub Repo
3 085
لیست کامل و جامعی از منابع فارسی برای برنامهنویسان! این مخزن شامل منابع ارزشمند و متنوعی است که به زبان فارسی تهیه شدهاند و میتوانند به بهبود مهارتها و دانش فنی شما کمک کنند. منابع به دقت دستهبندی شدهاند تا به راحتی قابل دسترس باشند. این لیست به خصوص برای افراد مبتدی و متوسط مناسب است و میتواند در آموزش، توسعه و پیشرفت حرفهای شما مفید باشد.
📱 GitHub Repo
3 085
این مجموعه داده شامل متون کوتاه فارسی برچسبگذاری شده با احساسات مختلف است که به منظور تحلیل احساسات در زبان فارسی ایجاد شده است. با استفاده از این دیتاست، میتوانید پروژههای تحلیل احساسات را در حوزههای مختلفی مانند شبکههای اجتماعی، بازخورد مشتریان یا تحلیل متون بهکار بگیرید. این دیتاست شامل متونی با برچسبهایی مثل خوشحالی، ناراحتی، خشم و غیره است که برای تمرین و آموزش مدلهای ماشین لرنینگ و پردازش زبان طبیعی بسیار مفید خواهد بود.
📱 GitHub Repo
3 085
اگر به دنبال ارتقا تجربیات خود در حوزه پردازش زبان طبیعی (NLP) به زبان فارسی هستید، حتماً به این لینک نگاهی بیندازید! FaMoji یک دیتاست غنی شامل بیش از ۲۰۰ هزار جفت جمله و اموجی است که به شما کمک میکند تا مدلهای خود را برای تطابق متغیرهای متنی با اموجیهای مناسب بهبود ببخشید. این دیتاست میتواند در پروژههای تحلیل احساسات، شبکههای اجتماعی و چتباتها بسیار کاربردی باشد.
📱 GitHub Repo
3 085
برای علاقهمندان به علم داده و کسانی که میخواهند به صورت خودآموز به این حوزه ورود کنند، این مخزن گیتهاب یک منبع بسیار کارآمد و کامل است. این مخزن شامل مجموعهای از منابع آموزشی، دورهها، کتابها و تمرینهای عملی است که میتواند شما را از سطح مبتدی به حرفهای در علم داده هدایت کند. این منابع بصورت جامع و مرحلهبهمرحله تنظیم شدهاند و میتوانید آنها را برای یادگیری مهارتهای مورد نیاز در حوزه علم داده، تحلیل دادهها و یادگیری ماشین استفاده کنید. همین حالا شروع کنید و سفری جذاب به دنیای علم داده را آغاز نمایید.
📱 GitHub Repo
3 085
یک پروژه فوقالعاده برای علاقمندان به پردازش زبان طبیعی! هدف این پروژه تشخیص نیت کاربران از جملات بلند و پیچیده است. این ابزار قدرتمند میتواند در انواع برنامههای چتبوت، تحلیل گفتگو و حتی دستیارهای هوشمند مورد استفاده قرار گیرد. اگر به حوزه NLP علاقه دارید، این پروژه میتواند مرجع خوبی برای شما باشد!
📱 GitHub Repo
3 085
https://huggingface.co/datasets/dadashzadeh/Persian_abbreviations
لیست مخفف ها همراه با دسته بندی
https://huggingface.co/datasets/dadashzadeh/Manufacturers-Persian
برند های سایت دیجی کالا
https://huggingface.co/datasets/dadashzadeh/Persian_Cooking
دستور پخت و آشپزی
https://huggingface.co/datasets/dadashzadeh/Collection-of-drug-names-in-Persian
نام های دارو همراه با دسته بندی
3 085
حالا بعضی منت میزارند و لطف می کنند و دیسلاک میکنند
شاید عجیب باشه ولی این حرکات، آدم را دلسرد میکنه از ایدههای بزرگتری که واسه کانال داره
3 085
از عجایب روزگار
یک کانالی هست که به صورت مستمر سعی میکنه جدیدترین مطالبی که به چشمش میاد، منتشر کنه که لازم نباشه هر روز توی گیتهاب سرچ کنید و صرفه جویی زمانی براتون بشه
و تا جای ممکن تبلیغ قبول نکنه
یعنی با وجود پیشنهادهای تبلیغاتی زیاد
ترجیح بده که با پست تبلیغاتی کانال شلوغ نشه
3 085
یک چتبات پزشکی کاربردی که میتواند به سوالات مختلف کاربران در زمینه سلامت و پزشکی پاسخ دهد. این پروژه با هدف ایجاد یک ابزار مفید برای دسترسی آسان و سریع به اطلاعات پزشکی و مشاوره اولیه طراحی شده است. این چتبات میتواند در کلینیکها، بیمارستانها، سایتهای سلامت و حتی اپلیکیشنهای موبایل مورد استفاده قرار گیرد (التبه نیاز به بهبود دارد). همچنین قابل استفاده در پروژههای هوش مصنوعی و پردازش زبان طبیعی است.
📱 GitHub Repo
3 085
من دوتا دیتاست فارسی ساختم اخیرا که جزو بزرگترینها توی نوع خودشونن
دیتاست اسامی و جنسیتشون که شامل نگارش انگلیسی اسامی هم هست
لینک هاگینگفیس و گیتهاب
https://huggingface.co/datasets/farbodbij/persian-gender-by-name
https://github.com/farbodbj/persian-gender-by-name
دیتاست فامیلیها و درصد تکرارشون:
https://huggingface.co/datasets/farbodbij/iranian-surname-frequencies
https://github.com/farbodbj/iranian-surname-frequencies
3 085
راهنمای کاربردی و ساده برای ساخت چتبات به زبان فارسی!
این پروژه شامل یک چتبات ساده به زبان فارسی است که با استفاده از الگوریتمهای پردازش زبان طبیعی (NLP) و مدلهای ترکیبی نوشته شده است. هدف این پروژه، فراهم آوردن یک مثال عملی و آموزشی جهت پیادهسازی چتباتهای زبان فارسی میباشد.
این چتبات برای پاسخ به سوالات متداول و ارائه اطلاعات ساده در محیطهای کاربردی مختلف مثل وبسایتها و اپلیکیشنها قابل استفاده است.
با مراجعه به این لینک، میتوانید به کدمنبع و مستندات پروژه دسترسی پیدا کنید و با استفاده از راهنماهای موجود، چتبات خود را بسازید.
📱 GitHub Repo
3 085
دوستی اومدن و مدل T5 فاین تیون کردن ک بتونه متون رسمی به محاوره تبدیل کنه و برعکس.
📱 GitHub Repo
3 085
این دیتاست شامل اطلاعات ارزشمند از پتنتهای ثبت شده در ایران است. مجموعه داده Persian-Patent-Dataset جمعآوری شده از منابع معتبر و کامل، توسط توسعهدهندگان برای استفاده پژوهشگران و علاقهمندان به تحلیل پتنتها و نوآوریها. این دیتاست شامل ویژگیهایی چون عنوان، خلاصه، شماره پتنت، سال ثبت و نام مخترع است. این مجموعه برای تحقیقات دانشگاهی، تحلیلهای حقوقی و توسعه مدلهای یادگیری ماشین در زمینه حقوق مالکیت فکری مناسب میباشد.
📱 GitHub Repo
3 085
به دنبال یادگیری Markdown به زبان فارسی هستید؟ این لینک یک آموزش جامع و کامل از مارکداون به زبان فارسی است. این مخزن شامل توضیحات مفصل و مثالهای کاربردی برای تمامی سینتکسها و ویژگیهای مارکداون است. این مجموعه برای برنامهنویسان، بلاگرها و هر کسی که میخواهد متون خود را به صورت شکیل و تمیز فرمت کند، بسیار مفید و کاربردی است. یادگیری مارکداون به شما کمک میکند تا مستندات و متون خود را به راحتی و با کیفیت بالا ایجاد کنید.
📱 GitHub Repo
3 085
#موقت
رفقا میشه لطفا آدرس یک پیج اینستایی که در حوزه برنامه نویسی و هوش مصنوعی دنبالش می کنید (ایرانی یا خارجی) و خیلی از محتواش لذت می برین، توی کامنت ها بزارین
حداقل کمتر وقتمون توی اینستا هدر بره و 4 چیز یاد بگیریم😊
