Habitat و مقیاس ذخیرهسازی ChatGPT برای یک میلیارد کاربر
از یک کتابخانه پایتونی ساده تا ۲۲ میلیون درخواست در ثانیه

اوپنایآی جزئیات بازطراحی زیرساخت ذخیرهسازی ChatGPT را منتشر کرد؛ سیستمی به نام Habitat که حالا ۲۲ میلیون درخواست در ثانیه را برای بیش از یک میلیارد کاربر پاسخ میدهد.
اوپنایآی در یک پست وبلاگی پرده برداشته که پشت صحنهی ChatGPT چه میگذرد؛ جایی که سیستمی به نام Habitat وظیفهی ذخیرهسازی را بر عهده دارد. این پلتفرم که روزی یک کتابخانه پایتونی ساده بوده، حالا بیش از یک میلیارد کاربر ChatGPT را سرویس میدهد و ۲۲ میلیون درخواست در ثانیه را مدیریت میکند.
Habitat کجای ChatGPT قرار دارد؟
هر بار که با ChatGPT گفتوگو میکنید، تاریخچهی مکالمات، تنظیمات حساب و حافظهی کاربری باید جایی ذخیره و در کسری از ثانیه بازیابی شود. Habitat همان لایهای است که این بار را به دوش میکشد. نکتهی جالب این است که این سیستم با یک کتابخانه پایتون شروع شد؛ چیزی که برای یک پروژهی در حال رشد کاملاً طبیعی است، اما در مقیاس میلیارد کاربری دیگر جواب نمیداد.
چرا از پایتون به معماری توزیعشده رسیدند؟
کتابخانهی داخلی یعنی همهچیز روی یک نقطه جمع شده است. با رشد کاربران، تأخیر و تکنقطهی خرابی به مسئلهی اصلی تبدیل میشود. اوپنایآی Habitat را به یک پلتفرم ذخیرهسازی توزیعشدهی جهانی تبدیل کرد. نتیجه این شده که سیستم حالا ۲۲ میلیون درخواست در ثانیه را تحمل میکند.
مقیاس یک میلیارد کاربری یعنی چه؟
عدد ۲۲ میلیون درخواست در ثانیه فقط یک رکورد تبلیغاتی نیست؛ ترافیک ChatGPT ذاتاً ناهموار است. ساعتهای اوج در مناطق مختلف دنیا روی هم میافتند و هر نسخهی جدید محصول میتواند ناگهان الگوی دسترسی به داده را عوض کند. سیستمی که برای این ترافیک طراحی شده باشد، باید هم در زمان خواندن سریع باشد و هم در برابر جهشهای ناگهانی مقاوم.
درس این ماجرا برای تیمهای دیگر چیست؟
الگوی تکرارشونده این است: اول یک ابزار ساده بساز، بعد وقتی مقیاس فرق کرد، آن را از نو طراحی کن. اوپنایآی بهجای مهاجرت به یک دیتابیس آماده، زیرساخت اختصاصی خودش را ساخت؛ تصمیمی که هزینهی بالایی دارد اما وقتی محصولت هستهی درآمدت است، منطقی است. این پست اولین قسمت از یک سری معرفی شده، پس احتمالاً جزئیات فنی بیشتری در ادامه منتشر خواهد شد.
این روایت نشان میدهد رقابت شرکتهای هوش مصنوعی فقط روی مدلها نیست؛ زیرساخت ذخیرهسازی و تحویل داده هم میدان رقابت جدی است. برای مطالعهی روایت کامل تیم مهندسی، به OpenAI Blog سر بزنید.
سؤالات رایج
Habitat دقیقاً چه چیزی ذخیره میکند؟ تاریخچهی مکالمات، تنظیمات حساب و حافظهی کاربری کاربران ChatGPT. این دادهها باید در کسری از ثانیه بازیابی شوند.
Habitat چه حجمی از ترافیک را مدیریت میکند؟ ۲۲ میلیون درخواست در ثانیه برای بیش از یک میلیارد کاربر ChatGPT؛ ترافیک ناهموار و جهشدار که با اوجگیری ساعات مختلف مناطق دنیا شدت میگیرد.
چرا اوپنایآی بهجای دیتابیس آماده، سیستم اختصاصی ساخت؟ کتابخانهی پایتونی اولیه در مقیاس میلیارد کاربری با تأخیر و تکنقطهی خرابی روبهرو شد. ساخت زیرساخت اختصاصی هزینهبر است، اما برای محصولی که هستهی درآمد شرکت است منطقی بوده.
بیشتر بخوانید
ادامه دهید — دنیای هوش مصنوعی بیپایان است
برای خواندن تحلیلهای بیشتر، صفحهٔ اصلی یا دستهٔ مرتبط را دنبال کنید. میتوانید با میانبرهای صفحهکلید هم بین مقالهها جابهجا شوید.
منبع اصلی خبر
OpenAI Blog
https://openai.com/index/scaling-storage-one-billion-users-part-oneتحریریه هوشنامه این خبر را بر اساس گزارش منبع اصلی بازنویسی و ویرایش کرده است. برای جزئیات بیشتر به منبع مراجعه کنید.
اخبار مرتبط
ابزارهاSlackforce Surfaces: ساخت داشبورد و گزارش با Slackbot داخل چت
قابلیت تازه اسلاک به نام Slackforce Surfaces به Slackbot اجازه میدهد از دل مکالمات و اپهای متصل، داشبورد و گزارش تعاملی بسازد؛ از اکتبر برای همه پلنها.
ابزارهاSiri AI منتشر شد؛ سیری هوشمند اپل با نسل جدید Apple Intelligence
اپل نسل جدید Apple Intelligence را با Siri AI عرضه کرد؛ دستیاری آگاه از صفحه و دادههای شخصی که فعلا فقط به انگلیسی و بهصورت آزمایشی کار میکند.
ابزارهاChatGPT Images 2.5 معرفی شد؛ تصویرسازی از روی اسکیس و عکس مرجع
نسخه تازه تصویرساز چتجیپیتی اسکیس دستی و عکس مرجع را پایه خروجی قرار میدهد و تصویری میسازد که به ایده کاربر نزدیکتر است.