OpenAI با معرفی مدل پیشرفته GPT-6 Astra و آموزش آن بر روی 100000 پردازنده گرافیکی Nvidia گام بزرگی در جهت هوش عمومی مصنوعی برداشت.
به گزارش سرویس هوش مصنوعی تکناک، شرکت OpenAI با عرضه مدل GPT-6 Astra موج جدیدی از هیجان و رقابت را در صنعت فناوری به راه انداخته است. اکنون این شرکت در کانون توجه جهانی قرار دارد و با معرفی مدل جدید خود، استانداردهای قابلیت های هوش مصنوعی را بازتعریف کرده است. در همان زمان، جنسن هوانگ، مدیرعامل انویدیا وارد این بحث شد و قابلیت های جدید OpenAI را تایید کرد که نشان دهنده شدت تغییرات در مسیر دستیابی به هوش مصنوعی عمومی یا AGI است.
مدل GPT-6 Astra بر اساس یک زیرساخت آموزشی عظیم است. این مدل با استفاده از یک کلاستر اختصاصی حاوی 100000 پردازنده گرافیکی آموزش داده شده است که هزینه این عملیات سنگین بین 500 میلیون تا 1 میلیارد دلار برآورد شده است. با در نظر گرفتن هزینه های پردازش به ازای هر GPU، این رقم می تواند از 540 میلیون دلار برای 90 روز کارکرد تا بیش از 1 میلیارد دلار برای 120 روز کارکرد متغیر باشد. انجام این فرآیند در مرکز داده Stargate در Abilene، تگزاس هزینه ها را برای OpenAI بهینه نگه داشته است. زیرا استفاده از زیرساخت های تامین کنندگان دیگر مانند CoreWeave با نرخ های بسیار بالاتر، هزینه ها را به شدت افزایش می داد.
فاز بعدی با 400 هزار پردازنده گرافیکی
اما این تنها آغاز داستان نیست. آینده OpenAI به پروژه ای بسیار بزرگتر از Astra گره خورده است. جنسن هوانگ اعلام کرد که گام بعدی فعال کردن فرآیند آموزش با استفاده از 400000 پردازنده گرافیکی خواهد بود. اگر این فرآیند با استفاده از تجهیزات پیشرفته ای مانند رک های سرور NVIDIA GB 200 NVL72 انجام شود، نیاز به انرژی الکتریکی به طرز باورنکردنی افزایش می یابد. تخمین زده می شود که OpenAI برای تکمیل این مرحله از آموزش به حدود 1.2 گیگاوات برق نیاز دارد که نشان دهنده مقیاس عظیم زیرساخت مورد نیاز برای نسل بعدی هوش مصنوعی است.
تفاوت اساسی بین GPT-6 Astra با مدل های قبلی در نحوه تعامل آن با دنیای نرم افزار است. برخلاف مدلهای قدیمی که توسعهدهندگان را ملزم به تعریف APIهای اختصاصی برای هر فعالیت خاص میکردند، Astra با نرمافزار به شیوهای شبیه به انسان تعامل دارد. این مدل می تواند در مرورگرها، صفحات گسترده، وب سایت ها و برنامه های دسکتاپ از طریق ایجاد عوامل هوشمند کار کند. Astra فقط دستورالعملها را ارائه نمیکند، بلکه میتواند گردشهای کاری چند مرحلهای را بهطور کامل پیادهسازی کند، اسناد سرتاسری تولید کند و ارائههای پیچیده را آماده کند.
ساختار چند عاملی و تحمل خطا
قلب تپنده این مدل یک موتور استدلال مبتنی بر ساختار چند عاملی است. هنگام مواجهه با مسائل پیچیده، عامل اصلی مدل وظیفه سازماندهی را بر عهده می گیرد. او نظریه ای را برای حل مسئله تدوین می کند و از عوامل فرعی مختلف برای آزمایش فرضیه ها و تأیید نتایج به طور موازی استفاده می کند. این ویژگی باعث شده تا مدل در برابر پدیده «حلقه مرگ» یا گیر افتادن در چرخه های خطای مکرر بسیار مقاوم باشد. در واقع، Astra قادر است کدهای خود را خود تشخیص داده و استراتژی های عملیاتی خود را در لحظه تغییر دهد.
با وجود این پیشرفت های چشمگیر، بحث های علمی و فنی همچنان ادامه دارد. بسیاری از کارشناسان تعریف دقیق AGI را به توانایی هوش مصنوعی در درک و ترسیم مدل های سه بعدی مرتبط می کنند. با این حال، منتقدان معتقدند که GPT-6 Astra همچنان در برخی شاخص های کلیدی از رقبای خود عقب است. به عنوان مثال، مدل Fable 5.1 از Anthropic همچنان در شاخص های تخصصی مانند SWE-bench Pro، Artificial Intelligence Index و همچنین در زمینه اثبات های ریاضی رسمی (ProofBench v1.1) از Astra بهتر عمل می کند. به نوشته Wccftechاین رقابت فشرده نشان می دهد که مسیر دستیابی به هوش عمومی مصنوعی، فراتر از افزایش صرف تعداد پردازنده ها و قدرت محاسباتی، نیازمند تکامل در ساختارهای استدلال و دقت در حل مسائل پیچیده است.
















گفتگو در مورد این post