تازه
ابزارها

Habitat و مقیاس ذخیره‌سازی ChatGPT برای یک میلیارد کاربر

از یک کتابخانه پایتونی ساده تا ۲۲ میلیون درخواست در ثانیه

Habitat و مقیاس ذخیره‌سازی ChatGPT برای یک میلیارد کاربر
تحریریه هوشنامه۲۴ شهریور ۱۴۰۵۲ دقیقه مطالعه۱ بازدید۵۳ دقیقه پیش
عادی

اوپن‌ای‌آی جزئیات بازطراحی زیرساخت ذخیره‌سازی ChatGPT را منتشر کرد؛ سیستمی به نام Habitat که حالا ۲۲ میلیون درخواست در ثانیه را برای بیش از یک میلیارد کاربر پاسخ می‌دهد.

اوپن‌ای‌آی در یک پست وبلاگی پرده برداشته که پشت صحنه‌ی ChatGPT چه می‌گذرد؛ جایی که سیستمی به نام Habitat وظیفه‌ی ذخیره‌سازی را بر عهده دارد. این پلتفرم که روزی یک کتابخانه پایتونی ساده بوده، حالا بیش از یک میلیارد کاربر ChatGPT را سرویس می‌دهد و ۲۲ میلیون درخواست در ثانیه را مدیریت می‌کند.

Habitat کجای ChatGPT قرار دارد؟

هر بار که با ChatGPT گفت‌وگو می‌کنید، تاریخچه‌ی مکالمات، تنظیمات حساب و حافظه‌ی کاربری باید جایی ذخیره و در کسری از ثانیه بازیابی شود. Habitat همان لایه‌ای است که این بار را به دوش می‌کشد. نکته‌ی جالب این است که این سیستم با یک کتابخانه پایتون شروع شد؛ چیزی که برای یک پروژه‌ی در حال رشد کاملاً طبیعی است، اما در مقیاس میلیارد کاربری دیگر جواب نمی‌داد.

چرا از پایتون به معماری توزیع‌شده رسیدند؟

کتابخانه‌ی داخلی یعنی همه‌چیز روی یک نقطه جمع شده است. با رشد کاربران، تأخیر و تک‌نقطه‌ی خرابی به مسئله‌ی اصلی تبدیل می‌شود. اوپن‌ای‌آی Habitat را به یک پلتفرم ذخیره‌سازی توزیع‌شده‌ی جهانی تبدیل کرد. نتیجه این شده که سیستم حالا ۲۲ میلیون درخواست در ثانیه را تحمل می‌کند.

مقیاس یک میلیارد کاربری یعنی چه؟

عدد ۲۲ میلیون درخواست در ثانیه فقط یک رکورد تبلیغاتی نیست؛ ترافیک ChatGPT ذاتاً ناهموار است. ساعت‌های اوج در مناطق مختلف دنیا روی هم می‌افتند و هر نسخه‌ی جدید محصول می‌تواند ناگهان الگوی دسترسی به داده را عوض کند. سیستمی که برای این ترافیک طراحی شده باشد، باید هم در زمان خواندن سریع باشد و هم در برابر جهش‌های ناگهانی مقاوم.

درس این ماجرا برای تیم‌های دیگر چیست؟

الگوی تکرارشونده این است: اول یک ابزار ساده بساز، بعد وقتی مقیاس فرق کرد، آن را از نو طراحی کن. اوپن‌ای‌آی به‌جای مهاجرت به یک دیتابیس آماده، زیرساخت اختصاصی خودش را ساخت؛ تصمیمی که هزینه‌ی بالایی دارد اما وقتی محصولت هسته‌ی درآمدت است، منطقی است. این پست اولین قسمت از یک سری معرفی شده، پس احتمالاً جزئیات فنی بیشتری در ادامه منتشر خواهد شد.

این روایت نشان می‌دهد رقابت شرکت‌های هوش مصنوعی فقط روی مدل‌ها نیست؛ زیرساخت ذخیره‌سازی و تحویل داده هم میدان رقابت جدی است. برای مطالعه‌ی روایت کامل تیم مهندسی، به OpenAI Blog سر بزنید.

سؤالات رایج

Habitat دقیقاً چه چیزی ذخیره می‌کند؟ تاریخچه‌ی مکالمات، تنظیمات حساب و حافظه‌ی کاربری کاربران ChatGPT. این داده‌ها باید در کسری از ثانیه بازیابی شوند.

Habitat چه حجمی از ترافیک را مدیریت می‌کند؟ ۲۲ میلیون درخواست در ثانیه برای بیش از یک میلیارد کاربر ChatGPT؛ ترافیک ناهموار و جهش‌دار که با اوج‌گیری ساعات مختلف مناطق دنیا شدت می‌گیرد.

چرا اوپن‌ای‌آی به‌جای دیتابیس آماده، سیستم اختصاصی ساخت؟ کتابخانه‌ی پایتونی اولیه در مقیاس میلیارد کاربری با تأخیر و تک‌نقطه‌ی خرابی روبه‌رو شد. ساخت زیرساخت اختصاصی هزینه‌بر است، اما برای محصولی که هسته‌ی درآمد شرکت است منطقی بوده.

بیشتر بخوانید

ادامه دهید — دنیای هوش مصنوعی بی‌پایان است

برای خواندن تحلیل‌های بیشتر، صفحهٔ اصلی یا دستهٔ مرتبط را دنبال کنید. می‌توانید با میانبرهای صفحه‌کلید هم بین مقاله‌ها جابه‌جا شوید.

این مطلب را به اشتراک بگذارید

منبع اصلی خبر

OpenAI Blog

https://openai.com/index/scaling-storage-one-billion-users-part-one

تحریریه هوشنامه این خبر را بر اساس گزارش منبع اصلی بازنویسی و ویرایش کرده است. برای جزئیات بیشتر به منبع مراجعه کنید.

اخبار مرتبط