دسته

بهترین هوش مصنوعی برای ترجمه فارسی

در این دسته یک شکاف معماری بین دو مولفه وجود دارد: مدلی که فارسی در فهرست زبان رسمی اش ثبت شده، قابل خرید و استقرار مستقیم نیست؛ و مدلی که می توان روی زیرساخت خود اجرا کرد، فارسی را اصلا در مشخصات فنی اش نام نبرده. جدول زیر همین شکاف را مستند می کند، نه کیفیت ادبی ترجمه هر مدل.

  • هفت نامزد، پنج ردیف با رتبه فعال
  • وزن معیار باز بودن: ۳۰ از ۱۰۰
  • ستون مستقل برای دسترسی از ایران

آخرین بررسی: این صفحه یک مرجع است. با هر نسخه تازه، منابع سازنده دوباره خوانده و صفحه بهروز می شود. چه چیزی عوض شد

امتیاز هر ابزار از کجا می آید

حلقه زیر، همان وزن هایی است که در سرستون های جدول پایین نوشته شده.

۱۰۰وزن ها
  • فارسی در مشخصات فنی ۳۵
  • باز بودن پروانه ۳۰
  • شمار زبان پوشش داده شده ۲۵
  • دسترسی از ایران ۱۰

وزن ها را ما انتخاب کرده ایم و همین تنها جای سلیقه این جدول است. اگر وزن دیگری درست تر می دانید، ترتیب هم عوض می شود.

رتبه بندی امروز، مستند بر فهرست زبان و پروانه هر سازنده

ستون فارسی صرفا وضعیت ثبت را نشان می دهد: آیا سازنده فارسی را در فهرست همان مدل درج کرده، نه کیفیت خروجی ترجمه. برای مدلی که سازنده اصلا فهرست زبان منتشر نکرده، این ستون در وضعیت «تاییدنشده» می ماند.

بهترین هوش مصنوعی برای ترجمه فارسی
رتبه ابزار امتیاز فارسی در مشخصات فنی ۳۵ باز بودن پروانه ۳۰ شمار زبان پوشش داده شده ۲۵ دسترسی از ایران ۱۰
۱ کامند ای ترنسلیت انتخاب فعلی ۷۰.۰ ۲/۲ ۰/۳ ۲۳ منبع: docs.cohere.com مسدود / راه کارآمدی ندارد
۲ آیا اکسپنس ۳۲بی ۶۷.۵ ۱/۲ ۱/۳ ۲۳ منبع: docs.cohere.com مسدود / راه کارآمدی ندارد
۳ کامند ای ریزنینگ ۳۵.۰ تایید نشده ۰/۳ ۲۳ منبع: docs.cohere.com مسدود / راه کارآمدی ندارد
۴ لاما ۴ مووریک ۳۰.۰ ۰/۲ ۲/۳ ۱۲ منبع: huggingface.co تایید نشده
۵ لاما ۴ اسکات ۳۰.۰ ۰/۲ ۲/۳ ۱۲ منبع: huggingface.co تایید نشده

سلول خالی یعنی آن عدد را نتوانسته ایم تایید کنیم، نه اینکه ابزار صفر گرفته است.

پشت هر عدد

هر نمره داوری این جدول یک دلیل نوشته شده دارد و ستون ایران می گوید چطور بررسی شده. آن دو اینجا بازند. رد اندازه گیری هر عدد، یعنی اینکه از کدام ردیف کدام لیدربورد و با چند رای آمده، زیر همان مدل باز می شود.

۱ کامند ای ترنسلیت

فارسی در مشخصات فنی ۲/۲ مستندات کوهر ۲۳ زبان پشتیبانی شده را تک به تک فهرست کرده و فارسی آخرین ورودی آن فهرست است؛ همان سند این نسخه را زیرساخت ترجمه ماشینی رسمی کوهر معرفی می کند. پس هم ثبت در مشخصات فنی و هم اعلام سازنده هر دو موجود است.

باز بودن پروانه ۰/۳ هیچ وزنی در دسترس عمومی منتشر نشده؛ تنها مسیر دسترسی، سطح یکپارچه سازی API اختصاصی کوهر است.

دسترسی از ایران مسدود / راه کارآمدی ندارد منبع این رده بندی سند حقوقی است، نه اندازه گیری شبکه: قرارداد SaaS کوهر ایران را به صراحت در تعریف Restricted Location قرار داده و دسترسی مشتری از چنین محدوده ای را ممنوع اعلام کرده است. استخراج از متن قرارداد است، نه از پروب اتصال.

۲ آیا اکسپنس ۳۲بی

فارسی در مشخصات فنی ۱/۲ مشخصات کارت مدل، ۲۳ زبان را به صورت فهرست شمرده که فارسی یکی از آن هاست. با این حال، طبقه بندی رسمی کوهر برای این مدل «پژوهشی چندزبانه» است، نه «ترجمه»، و همین طبقه بندی مانع رسیدن به پله دو در این معیار می شود.

باز بودن پروانه ۱/۳ وزن های مدل روی هاگینگ فیس عرضه شده اند، اما پروانه CC BY-NC 4.0 با پیوست استفاده مجاز حاکم است؛ بند NC یعنی استقرار در بار تولیدی تجاری خارج از دامنه مجاز است.

دسترسی از ایران مسدود / راه کارآمدی ندارد محدودیت دسترسی در سطح قرارداد تعریف شده، نه در سطح شبکه: قرارداد تجاری SaaS کوهر، ایران را در بند Restricted Location به اسم فهرست کرده و دسترسی مشتری از چنین موقعیتی را ممنوع اعلام می کند. این خروجی از استخراج متن قرارداد است؛ سنجش مستقل ترافیک شبکه انجام نشده.

۳ کامند ای ریزنینگ

باز بودن پروانه ۰/۳ در این نسخه هیچ وزنی به صورت باز عرضه نشده؛ تنها سطح تعامل، API اختصاصی کوهر است.

دسترسی از ایران مسدود / راه کارآمدی ندارد محدودیت دسترسی در سطح قرارداد تعریف شده، نه در سطح شبکه: قرارداد تجاری SaaS کوهر، ایران را در بند Restricted Location به اسم فهرست کرده و دسترسی مشتری از چنین موقعیتی را ممنوع اعلام می کند. این خروجی از استخراج متن قرارداد است؛ سنجش مستقل ترافیک شبکه انجام نشده.

۴ لاما ۴ مووریک

فارسی در مشخصات فنی ۰/۲ مشخصات منتشر شده لاما ۴ یک فهرست بسته دوازده زبانه را به عنوان مرز پوشش رسمی تعریف می کند: عربی، انگلیسی، فرانسوی، آلمانی، هندی، اندونزیایی، ایتالیایی، پرتغالی، اسپانیایی، تاگالوگ، تایلندی و ویتنامی. فارسی در این پوشش قرار نگرفته و فهرست با عبارت «از جمله» باز تعریف نشده، یعنی این محدودیت یک مرز مشخصه است نه یک برآورد. ترکی هم خارج از این مرز است.

باز بودن پروانه ۲/۳ وزن ها به صورت عمومی منتشر شده و پروانه لاما ۴ بهره برداری تجاری را مجاز می شمارد، اما این پروانه یک مشخصه اختصاصی متا است، نه یک استاندارد باز شناخته شده: سقفی معادل ۷۰۰ میلیون کاربر فعال ماهانه در آن تعبیه شده و درج عبارت Built with Llama به عنوان یک الزام انطباق مشخص شده است.

۵ لاما ۴ اسکات

فارسی در مشخصات فنی ۰/۲ مشخصات منتشر شده لاما ۴ یک فهرست بسته دوازده زبانه را به عنوان مرز پوشش رسمی تعریف می کند: عربی، انگلیسی، فرانسوی، آلمانی، هندی، اندونزیایی، ایتالیایی، پرتغالی، اسپانیایی، تاگالوگ، تایلندی و ویتنامی. فارسی در این پوشش قرار نگرفته و فهرست با عبارت «از جمله» باز تعریف نشده، یعنی این محدودیت یک مرز مشخصه است نه یک برآورد. ترکی هم خارج از این مرز است.

باز بودن پروانه ۲/۳ وزن ها به صورت عمومی منتشر شده و پروانه لاما ۴ بهره برداری تجاری را مجاز می شمارد، اما این پروانه یک مشخصه اختصاصی متا است، نه یک استاندارد باز شناخته شده: سقفی معادل ۷۰۰ میلیون کاربر فعال ماهانه در آن تعبیه شده و درج عبارت Built with Llama به عنوان یک الزام انطباق مشخص شده است.

برای رتبه دادن، داده تاییدشده کافی نداریم

اینها ابزارهای واقعی اند و پیگیری شان می کنیم، ولی بیش از نیم وزن معیارها برایشان عدد تاییدشده ندارد، پس رتبه دادنشان حدس زدن بود.

این رتبه بندی چطور حساب می شود

هر معیار زیر یک وزن دارد و یک منبع. وزن را عوض کنید، کل جدول از نو حساب می شود. هیچ جای این مرجع، جایگاهی دستی گذاشته نشده است.

معیار وزن شاهد
فارسی در مشخصات فنی ۳۵ مقیاس تعریف شده، با دلیل نوشته برای هر انتسابخروجی ترجمه خودش یک زبان مقصد است؛ مدلی که فارسی را در مشخصاتش ثبت نکرده، برای متن فارسی یک حدس عملیاتی است، نه یک جزء قابل اتکا
باز بودن پروانه ۳۰ مقیاس تعریف شده، با دلیل نوشته برای هر انتساباین معیار در این دسته وزن ۳۰ می گیرد و در هیچ دسته دیگر این مرجع چنین وزنی ندارد، چون در ایران همان لایه ای از زنجیره تامین که غیرقابل استفاده است، API میزبانی شده است
شمار زبان پوشش داده شده ۲۵ مشخصات اعلامی سازندهفقط زمانی شمارش شده که سازنده فهرست کامل زبان ها را منتشر کرده یا عدد قطعی داده باشد؛ فهرست ناقص شمارش نمی شود
دسترسی از ایران ۱۰ ستون دسترسی ما، با روش اعلام شدهوزن پایینی دارد چون محور اصلی این بحث در صفحه اختصاصی «هوش مصنوعی در ایران» مستند شده، اما صفر هم نیست

دو مولفه ای که در این معماری از هم جدا افتاده اند

کوهر مدلی با نام Command A Translate در کاتالوگ خود دارد و در مستندات فنی آن را صراحتا «مدل ترجمه ماشینی» اختصاصی خود معرفی کرده است. همان مستندات ۲۳ زبان پشتیبانی شده را تک به تک فهرست می کند: انگلیسی، فرانسوی، اسپانیایی، ایتالیایی، آلمانی، پرتغالی، ژاپنی، کره ای، چینی، عربی، روسی، لهستانی، ترکی، ویتنامی، هلندی، چکی، اندونزیایی، اوکراینی، رومانیایی، یونانی، هندی، عبری و فارسی.

هر چهار زبانی که این سایت با آنها منتشر می شود، درون همین فهرست ۲۳ تایی قرار دارند. برای هر پروژه با استقرار دوزبانه یا چندزبانه، این دقیق ترین سند موجود درباره پوشش زبانی در کل این مرجع است.

در طرف مقابل معماری، متا لاما ۴ را با وزن باز عرضه می کند و پروانه آن استفاده تجاری را هم مجاز می داند؛ یعنی مولفه ای که می توان آن را روی زیرساخت داخلی مستقر کرد و خروجی اش را به فروش رساند. مشخصات فنی آن فهرست بسته دوازده زبانه دارد: عربی، انگلیسی، فرانسوی، آلمانی، هندی، اندونزیایی، ایتالیایی، پرتغالی، اسپانیایی، تاگالوگ، تایلندی و ویتنامی. فارسی در این فهرست نیست. ترکی هم نیست. متا این فهرست را با عبارتی مانند «از جمله» باز نگذاشته، پس این یک مشخصه بسته و قطعی است.

در نتیجه، محور رتبه بندی این دسته کیفیت خروجی نیست؛ محور آن این است: آیا زبان مقصد شما در مشخصات فنی مدل ثبت شده، و آیا اصلا مسیر دسترسی به آن باز است.

وارونگی پنجره متن در معماری این دو مدل

Command A Translate پنجره عملیاتی هشت هزار توکنی دارد؛ کوتاه ترین ظرفیت در کل این کاتالوگ، کوتاه تر از هر مولفه دیگری که در این مرجع ثبت شده. لاما ۴ اسکات در سوی دیگر، پنجره ده میلیون توکنی دارد، بلندترین مقدار ثبت شده.

یعنی مولفه ای که فارسی را می شناسد، ظرفیت پردازش چند صفحه دارد، و مولفه ای که فارسی را نمی شناسد، یک کتاب کامل را در یک فراخوانی می پذیرد. این یک تصادف معماری نیست: مدل ترجمه اختصاصی برای واحد جمله و پاراگراف طراحی شده، نه برای سند کامل.

پیامد عملیاتی این وارونگی جایی مستند نشده: با یک مدل ترجمه اختصاصی، پایپ لاین ترجمه یک سایت باید صفحه به صفحه اجرا شود، نه در یک عبور یکپارچه. اگر نیاز عملیاتی شما عبور یک سند بلند در یک فراخوانی است، در واقع مولفه ای را انتخاب می کنید که برای این بار کاری طراحی نشده، و این انتخاب باید آگاهانه در معماری پروژه ثبت شود.

چرا باز بودن پروانه در این دسته وزن ۳۰ می گیرد

در سایر دسته های این مرجع، وزن باز بودن پروانه یک مولفه جانبی در معماری امتیازدهی است. در این دسته چنین نیست.

دلیل مستقیم است: برای کاربر ایرانی، همان لایه از زیرساخت که در عمل غیرقابل استفاده است، API میزبانی شده است. توافق تجاری کوهر ایران را صریحا در تعریف Restricted Location خود ثبت کرده است. بنابراین مولفه ای که وزن آن منتشر شده و پروانه آن استفاده تجاری را مجاز می کند، در این معماری یک جزء عملیاتی واقعی است؛ بقیه مولفه ها صرفا مستنداتی درباره یک ابزار غیرقابل استقرار هستند.

همین معیار، تفاوتی را آشکار می کند که یک پرچم دودویی «باز است یا نه» پنهان می کند. آیا اکسپنس وزن باز منتشر می کند، اما زیر پروانه CC BY-NC عمل می کند؛ یعنی اگر آن را برای ترجمه تجاری سایت مشتری به کار ببرید و بابتش هزینه دریافت کنید، پروانه را نقض کرده اید. لاما ۴ استفاده تجاری را مجاز می داند، اما زیر پروانه اختصاصی متا با سقف ۷۰۰ میلیون کاربر فعال ماهانه و الزام درج نشان Built with Llama. میسترال لارج ۳ زیر پروانه آپاچی ۲ عرضه شده، آزادترین پروانه در کل این جدول، اما فارسی را در مشخصات فنی خود ثبت نکرده است.

چهار معیاری که عمدا از این رابرک حذف شده اند

نمره کیفیت ترجمه. کوهر Command A Translate را «مدل ترجمه ماشینی پیشرفته» خود معرفی می کند، بدون انتشار هیچ عدد قابل استناد. سایر سازنده ها هم چنین عددی منتشر نکرده اند. ستونی که برای هیچ نامزدی مقدار ندارد، در معماری رابرک جایی ندارد.

قیمت. از هفت نامزد این جدول، تنها دو مورد قیمت منتشرشده دارند. کوهر برای نسل جدید مدل هایش نرخی چاپ نمی کند، میسترال اصلا نرخ سطح مدل منتشر نمی کند، و متا وزن مدل را عرضه می کند بدون آنکه قیمتی در میان باشد. ستونی با تنها دو سلول پر، پنج نامزد دیگر را بدون دلیل فنی در رتبه پایین می کشد.

جهت ترجمه. کیفیت ترجمه متقارن نیست: مسیر فارسی به انگلیسی با مسیر انگلیسی به فارسی از نظر عملکردی یکسان نیستند، و این برای هر مترجم حرفه ای شناخته شده است. هیچ سازنده ای در این مرجع داده مجزا برای هر جهت منتشر نمی کند، پس این صفحه هم درباره آن ادعایی ندارد. فهرست زبان یک مجموعه است، نه یک جفت جهت دار.

و پنجره متن، معیاری که به صورت آزمایشی وارد رابرک شد و سپس حذف شد؛ دلیل حذف آن را اینجا ثبت می کنیم چون برای دسته های بعدی هم کاربرد دارد. موتور رتبه بندی هر ستون عددی را بین کمینه و بیشینه نامزدها نرمال سازی می کند. در اینجا کمینه پنجره ۸ هزار توکن است و بیشینه ۱۰ میلیون، فاصله ای در حد سه مرتبه بزرگی. نتیجه عملی این بود که ۲۵۶ هزار توکن از سقف ۱۵ نمره ۰.۴ می گرفت و ۱۲۸ هزار توکن ۰.۲، در حالی که فاصله واقعی میان ۸ هزار و ۲۵۶ هزار در عمل ۳۲ برابر است. ستونی که یک تفاوت ۳۲ برابری را به صورت «۰.۴ در برابر ۰.۲» نشان می دهد، آن تفاوت را اندازه گیری نمی کند؛ این معیار خطای سیستماتیک تولید می کند. به همین دلیل عدد از جدول خارج شد و تحلیل آن در متن بالا باقی ماند.

دو ردیف بدون رتبه در این معماری

زیر جدول دو نامزد قرار دارند که موتور رتبه بندی نتوانسته برایشان رتبه محاسبه کند، هر دو به یک دلیل مشترک: سازنده برای همان مدل مشخص فهرست زبان منتشر نکرده است.

یکی Command A+ است، پرچمدار خط تولید کوهر. مستندات کوهر برای این مدل ادعای «توانایی ترجمه در سطح جهانی» را ثبت می کند، اما هیچ فهرست زبان و هیچ عدد قطعی برای آن منتشر نمی کند. یعنی ادعای عملکردی وجود دارد، بدون داده ای که بتوان به آن استناد کرد.

دیگری میسترال لارج ۳ است که آزادترین پروانه کل این جدول را دارد: آپاچی ۲، وزن باز، مجوز کامل استفاده تجاری، دقیقا همان مشخصه ای که این دسته وزن دوم را به آن اختصاص داده است. با این حال میسترال برای لارج ۳ نه فهرست زبان منتشر می کند و نه فهرست کشور، و همان فهرست جزئی هم صراحتا کامل اعلام نشده. مدلی که از نظر پروانه بهترین گزینه این جدول بود، صرفا به دلیل نبود این دو سند از جدول رتبه بندی حذف شد.

این وضعیت پنهان نمی شود، چون همین شفافیت است که اعتبار جدول را تضمین می کند: نامزدی که شاهد مستند ندارد، رتبه نمی گیرد، حتی وقتی فرضیه ما این باشد که عملکردش خوب است.

آنچه این جدول اندازه گیری نمی کند

هر سلول ستون فارسی روی این صفحه فقط این را می گوید: سازنده این زبان را در مشخصات فنی اش ثبت کرده است. هیچ خروجی واقعی خوانده یا ارزیابی نشده.

این همان محدودیت روش شناسی است که دسته صداگذاری هم دارد، و مرز صادقانه کل این متدولوژی همین است. ما فهرست های منتشرشده رسمی را می خوانیم و به آنها استناد می کنیم؛ ارزیابی میزان طبیعی بودن خروجی فارسی این مدل ها یک کار مجزا است و ادعای انجام آن را نداریم.

چه زمانی انتخاب اول ما مناسب نیست

  • اگر بار کاری شما فقط میان انگلیسی و زبان های اروپایی است، ترتیب این جدول برای شما بهینه نیست: ردیف های پایین جدول دقیقا در همان زبان ها عملکرد قوی دارند و صرفا به دلیل نداشتن فارسی در رتبه پایین تری قرار گرفته اند.
  • اگر نیاز عملیاتی شما عبور یک سند بلند در یک فراخوانی واحد است، هیچ یک از ردیف های بالای جدول ظرفیت آن را ندارند و باید به سراغ مدل های با پنجره بزرگ بروید، با این پیش فرض که فارسی را در مشخصات فنی خود اعلام نکرده اند.
  • اگر نیاز شما ترجمه رسمی و مهردار است، هیچ مولفه ای در این صفحه برای آن کار طراحی نشده. آن نیاز یک مترجم رسمی می خواهد، نه یک مدل.

نقاط ضعف و محدودیت‌های شناخته‌شده

  • ستون فارسی از فهرست رسمی منتشرشده سازنده خوانده شده، نه از ارزیابی خروجی واقعی. کیفیت ترجمه اندازه گیری نشده است.
  • قیمت در این رابرک ستون مستقل ندارد، چون تنها دو نامزد از هفت مورد نرخ منتشرشده دارند.
  • جهت ترجمه اندازه گیری نشده. فهرست زبان یک مجموعه است و صرفا امکان هر جفت را نشان می دهد، نه اینکه هر دو جهت آن جفت کیفیت یکسان دارند.
  • ستون دسترسی از ایران از متن قرارداد و سیاست رسمی هر سازنده خوانده شده، نه از تست شبکه واقعی از داخل ایران.

جمع‌بندی فنی

اگر زیرساخت شما چندزبانه است و فارسی، عربی و ترکی هر سه در بار کاری شما حضور دارند، Command A Translate تنها مولفه ای است که هر سه را در مشخصات فنی خود ثبت کرده؛ در نظر داشته باشید پنجره عملیاتی آن هشت هزار توکن است و مسیر رسمی خرید آن از ایران وجود ندارد. اگر نیاز عملیاتی استقرار محلی مدل است، آیا اکسپنس فارسی را پوشش می دهد اما پروانه آن استفاده تجاری را مجاز نمی داند؛ این تناقض باید پیش از شروع پروژه در معماری تصمیم گیری لحاظ شود، نه در میانه اجرا.

پرسش هایی که واقعا پرسیده می شود

بهترین هوش مصنوعی برای ترجمه فارسی کدام است

بر پایه مستندات این صفحه، Command A Translate از کوهر، چون تنها مولفه ای است که سازنده آن را هم مدل ترجمه معرفی کرده و هم فارسی را در فهرست ۲۳ زبانه اش ثبت کرده. دو قید عملیاتی دارد که در همین جدول هم ثبت شده: پنجره آن هشت هزار توکن است و توافق تجاری کوهر ایران را به صراحت نام برده.

کدام مدل ترجمه روی زیرساخت داخلی قابل استقرار است

سه مولفه. آیا اکسپنس ۳۲بی که فارسی را ثبت کرده اما زیر پروانه CC BY-NC است و استفاده تجاری را مجاز نمی داند؛ لاما ۴ که پروانه تجاری دارد اما فارسی در فهرست دوازده زبانه اش نیست؛ و میسترال لارج ۳ که زیر پروانه آپاچی ۲ عرضه شده و فهرست زبان آن فارسی را نام نبرده.

این مدل ها فارسی به عربی را ترجمه می کنند

فهرست ۲۳ زبانه کوهر هر دو زبان را در بر دارد، پس این جفت از نظر پوشش داخل فهرست قرار می گیرد. اما فهرست زبان یک مجموعه است، نه تضمین کیفیت برای هر جفت مشخص، و هیچ سازنده ای عدد مجزا برای جفت های ترجمه منتشر نمی کند.

کیفیت خروجی فارسی این مدل ها چقدر است

این داده در دسترس نیست و ادعایی درباره آن نمی کنیم. این جدول صرفا نشان می دهد سازنده فارسی را در فهرست زبان همان مدل ثبت کرده یا نه. ارزیابی کیفیت نیازمند خواندن و سنجش خروجی واقعی است و چنین کاری انجام نشده.

برای ترجمه کامل یک سایت کدام مولفه را انتخاب کنیم

در صورت استفاده از مدل ترجمه اختصاصی، پایپ لاین باید صفحه به صفحه اجرا شود، چون پنجره هشت هزار توکنی ظرفیت بیش از چند صفحه را ندارد. اگر نیاز عملیاتی عبور یک سند بلند در یک فراخوانی است، در واقع مولفه ای انتخاب می شود که برای ترجمه طراحی نشده و فارسی را هم در مشخصات فنی خود اعلام نکرده است.

ترجمه و بومی سازی زیرساخت سایت شما بخشی از

خدمات ترجمه سایت