زیرساختی که آمازون در هوش مصنوعی عرضه می کند
آمازون در این مرجع دو لایه جدا است. نوا را خودش می سازد، هفت مدل برای متن، تصویر، ویدیو و گفتار، و از طریق Bedrock تقریبا هر سازنده دیگری را هم روی زیرساخت خودش عرضه می کند. کسی که می گوید «از هوش مصنوعی آمازون استفاده می کنیم» معمولا لایه دوم را منظور دارد، و این دو لایه تقریبا هیچ اشتراک معماری ندارند.
- هفت مدل در خط نوا
- لایه توزیع مدل سایر سازنده ها
- دسترسی بر اساس منطقه استقرار
آخرین بررسی: این صفحه یک مرجع است. با هر نسخه تازه، منابع سازنده دوباره خوانده و صفحه بهروز می شود. چه چیزی عوض شد
خانوادههای مدل
خط نوا، از واحد متنی مایکرو تا واحد صوتی سونیک.
نسخهها
| نسخه | استقرار | وضعیت | خانواده |
|---|---|---|---|
| نوا کانواس | نسخه جاری | نوا | |
| نوا لایت | نسخه جاری | نوا | |
| نوا مایکرو | نسخه جاری | نوا | |
| نوا پریمیر | نسخه جاری | نوا | |
| نوا پرو | نسخه جاری | نوا | |
| نوا ریل | نسخه جاری | نوا | |
| نوا سونیک | نسخه جاری | نوا |
آمازون در این مرجع دو لایه است، و کاربران آن دو را یکی می گیرند
وقتی کسی می گوید «هوش مصنوعی آمازون»، دو لایه کاملا متفاوت ممکن است منظورش باشد. یکی نوا است: هفت مدلی که خود آمازون ساخته. دیگری Bedrock است: لایه ای که مدل سازنده های دیگر را روی زیرساخت آمازون عرضه می کند.
و این لایه بزرگ است. صفحه قیمت گذاری Bedrock بخش نرخ گذاری جداگانه دارد برای AI21 Labs، آمازون نوا، آمازون تایتان، انتروپیک، کوهر، دیپ سیک، Luma AI، متا، میسترال، اوپن ای آی، کوئن، Stability AI، TwelveLabs و Writer. این بیشترین تعداد سازنده ای است که در این مرجع زیر یک زیرساخت واحد جمع شده اند.
نتیجه عملی: اگر جایی خواندید که فلان شرکت روی زیرساخت هوش مصنوعی آمازون ساخته شده، احتمال زیادی هست که واحد مدلی که واقعا اجرا می شود اصلا محصول آمازون نباشد. کلاد از انتروپیک، لاما از متا و کامند از کوهر همگی روی همان بدراک عرضه می شوند.
دویست زبان در سلول مشخصات، پانزده زبان در پاورقی
جدول مشخصات نوا یک ردیف دارد با عنوان «زبان های پشتیبانی شده» و برای هر چهار مدل متنی رقم «+۲۰۰» را ثبت می کند. همان سلول یک نشانه پاورقی دارد و متن پاورقی این است: «بهینه شده برای این ۱۵ زبان: انگلیسی، آلمانی، اسپانیایی، فرانسوی، ایتالیایی، ژاپنی، کره ای، عربی، چینی ساده شده، روسی، هندی، پرتغالی، هلندی، ترکی و عبری.»
عربی هست. ترکی هست. فارسی نیست.
این دقیقا همان الگویی است که در دسته صداگذاری هم مستند کردیم: رقم بزرگ در سلولی که مصرف کننده می خواند، فهرست واقعی در پاورقی ای که نمی خواند. «+۲۰۰» یعنی مدل با آن زبان ها کار می کند. «۱۵» یعنی آمازون برای کیفیت آنها تعهد داده. برای متن فارسی، شما در دسته اول قرار دارید نه دوم، و این تفاوت را باید پیش از برآورد هزینه دانست نه پس از آن.
مدل گفتاری این خط، نوا سونیک، شفاف تر مستند شده: پنج زبان، انگلیسی آمریکا و بریتانیا، فرانسوی، ایتالیایی، آلمانی و اسپانیایی. اینجا هیچ حدسی لازم نیست.
دسترسی در این معماری فهرست مرکزهای داده است، نه فهرست کشور
هر سازنده دیگری در این مرجع یک فهرست کشورهای پشتیبانی شده منتشر می کند. آمازون به جای آن فهرست منطقه استقرار دارد، و این تفاوت معماری واقعی است: مدل در یک مرکز داده مشخص اجرا می شود و مسیر شبکه شما باید به همان مرکز داده برسد.
نوا پریمیر تنها در دو مرکز داده مستقر است: US East (N. Virginia) و AWS GovCloud (US-West). پرو، لایت و مایکرو در N. Virginia، توکیو، سیدنی، لندن و GovCloud مستقر هستند و از طریق cross-region inference به اوهایو، اورگان، استکهلم، ایرلند، فرانکفورت، پاریس، توکیو، سنگاپور، سیدنی، سئول و بمبئی هم می رسند. کانواس و ریل در N. Virginia، ایرلند و توکیو مستقرند و سونیک در N. Virginia، استکهلم و توکیو.
در هیچ یک از این فهرست ها یک منطقه خاورمیانه ثبت نشده. آمازون منطقه خاورمیانه در زیرساخت خود دارد، اما نوا از آن سرو نمی شود. نزدیک ترین مرکز داده ای که یک مدل نوا واقعا در آن اجرا می شود بمبئی است یا فرانکفورت.
درباره ایران مشخصا: آمازون هیچ فهرست کشورهای پشتیبانی شده قابل استناد منتشر نمی کند، و قرارداد مشتری AWS رعایت برنامه های تحریمی را به عهده خود مشتری واگذار می کند. پس وضعیت را نه باز ثبت می کنیم و نه مسدود. آنچه می گوییم این است که مدرکی برای استناد پیدا نکردیم و شبکه را هم آزمایش نکرده ایم.
قوی ترین واحد خط، محدودترین واحد خط
نوا پریمیر پنجره متن یک میلیون توکنی دارد و سقف خروجی اش ده هزار توکن است. این نسبت، صد به یک، بازترین نسبت این کاتالوگ است و خود این عدد نشان می دهد مدل برای چه بار کاری طراحی شده: حجم ورودی بسیار بالا و خروجی کوتاه.
اما همان جدول سه محدودیت دیگر هم ثبت می کند که کمتر کسی بررسی می کند. پریمیر fine tuning ندارد. provisioned throughput ندارد. و فقط در دو منطقه مستقر است. یعنی قوی ترین واحد این خط کم دسترس ترین و کم انعطاف ترین آن هم هست. کاربردی که آمازون برایش تعریف کرده در همان مشخصات ثبت شده: پریمیر نقش «معلم» را دارد و واحدهای کوچک تر را از طریق distillation آموزش می دهد.
اگر دنبال واحدی هستید که واقعا در پروداکشن مستقر کنید، پرو و لایت گزینه های عملی این خط هستند، نه پریمیر.
چیزی که در این معماری قابل مستندسازی نیست
قیمت هیچ واحد نوایی. صفحه قیمت گذاری Bedrock جدول ها را دارد اما اعداد را سمت کلاینت تزریق می کند، و اچ تی ام ال ی که سرور ما دریافت می کند به جای رقم واقعی یک placeholder دارد. یعنی عددی برای استخراج وجود ندارد، پس ستون قیمت مدل های نوا در فهرست ما خالی مانده.
این را ثبت می کنیم چون یک مشکل واقعی برای هر کسی است که می خواهد پیش از ثبت نام هزینه را برآورد کند، و چون این دومین باری است که در این مرجع با همین الگو مواجه شده ایم. صفحه پلن های گوگل هم همین رفتار را دارد.
نقاط قوت مستند
- بیشترین تعداد سازنده زیر یک زیرساخت: صفحه قیمت گذاری بدراک برای چهارده خانواده مدل بخش جداگانه دارد
- پنجره متن یک میلیون توکنی نوا پریمیر، با شمار زبان، منطقه استقرار و شناسه مدل که همگی در یک جدول عمومی مستند شده اند
- عربی و ترکی هر دو در فهرست پانزده زبان تعهدشده ثبت شده اند
- مستندات برای هر مدل هم شناسه API و هم مناطق در دسترس را ثبت می کند، که برای برآورد تاخیر شبکه لازم است
نقاط ضعف و محدودیتهای شناختهشده
- فارسی در فهرست پانزده زبان بهینه شده ثبت نشده. رقم «+۲۰۰» در سلول یک تعهد نیست؛ پاورقی است که سطح تعهد را مشخص می کند.
- هیچ واحد نوایی از یک منطقه خاورمیانه سرو نمی شود، حتی از طریق cross-region inference.
- قیمت ها روی صفحه بدراک سمت کلاینت ساخته می شوند و از اچ تی ام ال صفحه قابل استخراج نیستند، پس ستون قیمت نوا خالی مانده است.
- نوا پریمیر نه fine tuning دارد و نه provisioned throughput، پس برای پروداکشن مقیاس پذیر مناسب نیست.
- نوا سونیک تنها پنج زبان را پشتیبانی می کند و فارسی در آنها نیست.
- فهرست کشورهای پشتیبانی شده قابل استنادی برای بدراک پیدا نکردیم، پس درباره دسترسی از ایران نه تایید می کنیم و نه رد.
جمعبندی فنی
اگر روی زیرساخت AWS مستقر هستید و می خواهید چند مدل از چند سازنده را زیر یک صورتحساب داشته باشید، بدراک منطقی ترین گزینه این مرجع است. اما «هوش مصنوعی آمازون» را با «مدل های خود آمازون» یکی نگیرید: نوا برای متن فارسی هیچ تعهدی ثبت نکرده، و برای فارسی باید سراغ سازنده ای بروید که فهرست زبانش را مستند کرده باشد.
پرسش هایی که واقعا پرسیده می شود
آیا نوا از فارسی پشتیبانی می کند
آمازون در سلول جدول «+۲۰۰ زبان» ثبت می کند و در پاورقی همان سلول پانزده زبان بهینه شده را نام می برد. فارسی در آن پانزده تا نیست. یعنی مدل با فارسی کار می کند، اما آمازون برای کیفیت آن تعهدی ثبت نکرده.
فرق نوا و بدراک چیست
نوا هفت مدلی است که خود آمازون ساخته. بدراک لایه ای است که آن هفت واحد را کنار مدل انتروپیک، متا، میسترال، کوهر و سایر سازنده ها روی یک زیرساخت عرضه می کند. یک نام، دو معماری.
نوا از ایران در دسترس است
نمی دانیم و ادعایی ثبت نمی کنیم. آمازون فهرست کشوری قابل استناد منتشر نکرده. آنچه مستند است این است که هیچ واحد نوایی از یک منطقه خاورمیانه سرو نمی شود و نزدیک ترین مراکز داده بمبئی و فرانکفورت هستند.
قیمت نوا چقدر است
نمی توانیم مستند کنیم. صفحه قیمت گذاری بدراک اعداد را با جاوااسکریپت پر می کند و در اچ تی ام ال صفحه رقمی وجود ندارد. ستون قیمت خالی یعنی داده ای برای استخراج نبود.