uz
Feedback
آکادمی علوم شقایق رحمانی

آکادمی علوم شقایق رحمانی

Kanalga Telegram’da o‘tish

آموزش علوم شیمی، فیزیک و کامپیوتر Admin: @melanee_teacher Mentor Bot: @MelaneeMentorbot

Ko'proq ko'rsatish
791
Obunachilar
Ma'lumot yo'q24 soatlar
-67 kun
-2130 kun
Postlar arxiv
یک پادکست بسیار جالب راجب LLM ها شنیدم: https://aprd.ir/ai-station-e11-mahdi-akhi-llm/

یک مقاله مختصر و مفید راجب آنچه که تا به حال در پروژه ی رمزگشایی خط میخی فارسی باستان با هوش مصنوعی انجام دادم، نوشتم. اگر ایرادی پیدا کردید خوشحال میشم بهم بگید. لینک مقاله ام در Medium: https://medium.com/@melanee-melanee/matching-and-translating-persian-old-cuneiform-inscriptions-by-ai-89cc431ba0be

یک مقاله مختصر و مفید راجب آنچه که تا به حال در پروژه ی رمزگشایی خط میخی فارسی باستان با هوش مصنوعی انجام دادم، نوشتم. لینک مقاله ام در Medium:

تا الان سه تا مدل OCR واسه زبان فارسی باستان نوشتم که دو تا مدلِ easyocr_old_persian و tessercat_old_persian کار میکنند. اگر
+4
تا الان سه تا مدل OCR واسه زبان فارسی باستان نوشتم که دو تا مدلِ easyocr_old_persian و tessercat_old_persian کار میکنند. اگر بخواید میتونید الان تست شون کنید. توجه کنید الان فقط مدل هارو نوشتم ولی چون برای شروع دیتای کمی بهش دادم، فعلا پرفورمنسش کمه ولی در آینده با دیتای بهتر و بیشتری مدلم رو train میکنم تا به نتایج بهتری برسم. در حال حاضر، طبق نتایجی که در عکس ها ملاحضه میکنید؛ confidence score مدلم حدود 0.5 هست. تصویر خط میخی ای که ملاحضه میکنید مربوط به ۱۲ خطِ آخر کتیبه ی داریوش بزرگ در تخت جمشید (کتیبه DPd) هست. لینک گیت هاب پروژه OCR: https://github.com/Melanee-Melanee/Old-Persian-Cuneiform-OCR #نتایج

پروژه ی OCR زبان فارسی باستان آپدیت شد✅: https://github.com/Melanee-Melanee/Old-Persian-Cuneiform-OCR

چه قاب قشنگی🥰🕊❤...
چه قاب قشنگی🥰🕊❤...

دوستان بالخره مدل OCR خط فارسی باستان رو نوشتم😍🥰🥳. یک ماه و نیم درگیر نوشتن مدلش بودم که بلخره خداروشکر دیروز موفق شدم خروجی مدلم رو بگیرم. البته الان هنوز دقت خوبی نداره و Confidence score= 0.5 هست؛ چون اول کار بودم دیتای کمی بهش دادم. شبکه های عصبیش با Torch نوشته شده. حالا ازین به بعد دیتای بیشتر و با کیفیت تری میخوام بهش بدم که به دقت خوبی برسم. خیلی خوشحالم ولی train کردنش خیلی طول کشید، حدود ۳ ساعت! کاش یه سیستم قوی داشتم بهتر میتونستم مدلم رو optimize کنم🥺.

خطای نصب پکیج های pip رو شاید این روزها زیاد ببینیم که میگه Timeout شدید؛ این خطا به علت مشکلات connection شما و احتمالا تحریم ها ایجاد میشه. اگر میخواید بدون استفاده از VPN و تغییر DNS بتونید این پکیج هارو نصب کنید چند تا نکته بهتون میگم. توجه کنید نکته ها رو برای سیستم عامل GNU/Linux و توزیع Ubuntu دارم میگم: ۱. پکیج منیجر apt رو همیشه آپدیت نگه دارید و  mirror هاشو جایی تنظیم کنید که بتونه آپدیت هارو بگیره چون پکیج منیجر pip خودش توسط پکیج منیجر apt مدیریت میشه! تنظیم میرورهای apt واسه توزیع ابونتو در این مسیره: etc/apt/sources.list ۲. خود pip رو ورژنش رو کنترل کنید که آخرین ورژن باشه، یعنی آپدیت باشه. ۳. تمام آپدیت های روزانه سیستم عامل لینوکس که مربوط به security update میشن رو انجام بدید، به خصوص آپدیت های مربوط به system components ۴. از میرور های ایرانی pip، مستقیم در کامندش استفاده کنید، ساختار کامندش اینطوری میشه: pip install اسم پکیج --index-url آدرس میرور برای مثال میتونید از کامند زیر که حاوی آدرس میرور aliyun هست برای نصب پکیج pandas استفاده کنید:
pip install pandas --index-url https://mirrors.aliyun.com/pypi/simple/
آدرس میرورهای دیگه ای که میتونید استفاده کنید: https://pypi.mirrors.ustc.edu.cn/simple/ https://repo.huaweicloud.com/repository/pypi/simple/ توجه: موقع کامند زدن دقت کنید پکیج منیجر شما با دستور pip کار میکنه یا pip3. کلا لینوکس یه سیستم عاملی هست که باید با آپدیت ها زنده نگهش داریم و نرم افزارهاش همه به صورت تو در تو به هم پیوسته هستند. اگر معماری لینوکس رو ندونیم، علت خطاهاشو متوجه نمیشیم و نمیتونیم برطرفشون کنیم. ولی وقتی بلدش باشیم دیگه معما چو حل گشت آسان شود... 🥰. موفق باشید مِلانی

عاشورای حسینی تسلیت باید🖤. دیروز داشتم فکر میکردم چقدر این محرم و عاشورا در ادبیات و فرهنگ کشور ما تاثیرگزار بوده، طی قرن ها چقدر شعر و موسیقی و نمایشنامه و آثار هنری و ادبی ازش ساختند. خیلی قشنگه، خیلی...

𐎠𐎢𐎼𐎶𐏀𐎡𐎠 (اهورامزدا) (Ahuramazda) اولین کلمه ای که از زبان فارسی باستان یاد گرفتم، کلمه ی "اهورامزدا" بود🥰. اگر داریوش
+3
𐎠𐎢𐎼𐎶𐏀𐎡𐎠 (اهورامزدا) (Ahuramazda) اولین کلمه ای که از زبان فارسی باستان یاد گرفتم، کلمه ی "اهورامزدا" بود🥰. اگر داریوش بزرگ میدونست قراره زبانی که که اختراع کرده، ۲۵۰۰ سال بعد توسط یه دخترخانمی به اسم مِلانی و توسط یه وسیله ای به اسم کامپیوتر ترجمه و رمزگشایی بشه قطعا از تعجب شاخ درمی آورد🤭. این عکس ها هم خواستگاه اولین جایی هست که در جهان مدل های AI روی خط میخی فارسی باستان اجرا شد (اینجا میز کارمه)😅. گیت هاب OCR پروژه: https://lnkd.in/dhbnpxDh بماند به یادگار #اهورامزدا #زبان_فارسی_باستان

تا حالا دو تا درس مهم ازین پروژه جدیدم (EOPL) گرفتم: اولیش اینکه وقتی برنامه ای مینویسم حتما شماره ورژن کتابخونه ها و ابزارهایی که استفاده میکنم رو مکتوب کنم به طوری که افراد دیگه چند سال بعد از من بتونند برنامه ی من رو اجرا کنند. دوم اینکه دیتاهایی که با ارزش هستند رو حتما براشون یه فایل metadata تهیه کنم. مثلا تصویر کتیبه های زبان فارسی باستان رو که من دارم از کل دنیا جمع آوری میکنم برای هر دایرکتوریش یه فایل metadata درست کردم و اطلاعات اون عکس هارو داخل یه فایل متادیتا با فرمت CSV ذخیره کردم.  برای دیتای text هم همین کارو کردم که مثلا ترجمه این کتیبه رو از کجا آوردم و کی ترجمه اش کرده و کلی مشخصات دیگه. این دیتاها چون با ارزش هستند و هر کدومشون جزو اسناد هویتی کشورمون محسوب میشن من مجبور بودم فایل های متادیتا هم براشون درست کنم که البته کار بسیار سخت و وقت گیری هست چون باید دیتارو با دقت زیاد، ویرگول به ویرگول، سل به سل وارد این فایل متادیتا کنم! و اینکه وقتی دیتاست من به مرور زمان بزرگ میشه؛ کار پردازش دیتای من راحت تر میشه. برای مثال متادیتای دیتاهایی که از موزه بریتانیا جمع آوری کردم رو ببینید: https://github.com/Electronic-Old-Persian-Library/Old-Persian-Dataset/tree/main/imagedata/british_museum/metadata

آقای Roman Heut یکی از دولوپرهای openai قدرت ChatGPT رو در این فیلم نشون داده؛ من فقط دلم میخواد گریه کنم الان😭🥺. https://www.linkedin.com/posts/genai-works_ai-generativeai-innovation-activity-7216439181898616832-dFPA?utm_source=share&utm_medium=member_android

معرفی زنده یاد خانم دکتر بدرالزمان قریب، از اساطیر زبان شناسی ایران و استاد زبان های باستانی دانشگاه تهران از زبانِ دکتر مجتبایی استاد دانشگاه تهران: آشنایی من با بدرالزمان قریب به پیش از فرهنگستان زبان و ادب فارسی و به سال‌ ۱۳۲۹ برمی‌گردد، زمانی که با هم در دانشکده ادبیات هم دوره بودیم. خاطرم هست زمانی هم که در دانشگاه هاروارد مشغول تحصیل بودم، وی که در دانشگاه پنسیلوانیا تحصیل می‌کرد به شهر کمبریج آمد تا با دکتر ریچارد فرای زبان خوارزمی کار کند. وی تخصص‌اش زبان سُغدی بود که در این حوزه فرهنگ‌نامه ارزشمندی هم منتشر کرده است. دکتر مجتبایی در توضیح دلایل پرداختن بدرالزمان قریب به زبان سُغدی اظهار کرد: پیشرفت علم زمانی اتفاق می‌افتد که یک پژوهشگر به سمت موضوعی می‌رود که کسی اطلاعی از آن ندارد. محقق واقعی کسی است که به سراغ سوژه‌های جدید می‌رود؛ به نظر من رفتن به سمت موضوعی که همه می‌دانند و صحبت کردن درباره آن که دیگر هنر نیست. مجتبایی در پایان گفت: محقق واقعی به دنبال مجهولات فرهنگ و تاریخ می‌رود و به علت این که آن موضوع طرفدار ندارد و کسی به سمت او نرفته به سمت آن می‌رود و درباره آن می‌نویسد و عمرش را سر آن می‌گذارد تا نقطه تاریک را روشن کند. اگر کسی بخواهد برای دل جامعه کار کند به جایی نمی‌رسد، پس باید به روشن کردن قسمت‌های تاریک تاریخ بپردازد؛ حال می‌خواهد مردم بفهمند یا نفهمند. پ.ن: زبان سُغدی یکی از زبان های باستانی ایران هست که کمتر کسی در طول تاریخ بهش پرداخته. منبع

+1
کتاب ارزشمند "فرمانهای شاهنشاهان هخامنشی" نوشته نورمن شارپ نورمن شارپ سالها پیش بسیاری از کتیبه های با زبان #فارسی_باستان رو در این کتاب جمع آوری کرده.‌

بچه ها امروز جمعه اینترنت شما هم قطع یا کند شده؟
Anonymous voting