جدول امتیازات
ارزیابی مدل های هوشمند
-
(0 رأی)
سرویس جدول امتیازات
در این سرویس، مدلهای بزرگ زبانی (Large Language Models) بر روی وظایف حوزه علوم اسلامی و علوم انسانی ارزیابی و رتبهبندی شدهاند.
دیتاست مورد استفاده
این ارزیابیها با استفاده از دیتاست HIKMA (Humanities and Islamic Knowledge Assessment) صورت پذیرفته است که توسط مرکز تحقیقات کامپیوتری علوم اسلامی نور تهیه شده است.
ویژگیهای سرویس
- ارزیابی تخصصی: تمرکز بر وظایف حوزه علوم اسلامی و علوم انسانی
- رتبهبندی شفاف: مقایسه عملکرد مدلهای مختلف در قالب جدول امتیازات
- دادههای استاندارد: استفاده از دیتاست HIKMA برای ارزیابی یکسان و قابل مقایسه
- بهروزرسانی مداوم: افزودن مدلهای جدید و بهروزرسانی نتایج
کاربردها
- انتخاب مدل مناسب: کمک به پژوهشگران برای انتخاب بهترین مدل برای وظایف مرتبط
- مقایسه عملکرد: مشاهده نقاط قوت و ضعف مدلهای مختلف
- تحقیق و توسعه: استفاده از نتایج برای بهبود مدلهای موجود
- شفافیت علمی: ارائه ارزیابیهای استاندارد و قابل استناد
مزایا
- تخصصی بودن ارزیابیها در حوزه علوم اسلامی و انسانی
- استفاده از دیتاست اختصاصی و معتبر HIKMA
- رتبهبندی عادلانه و قابل مقایسه
- کمک به تصمیمگیری آگاهانه برای کاربران
جدول امتیازات
به این مورد امتیاز دهید
نظرات
برای نظر دادن وارد شوید
Loading comments...