کد خبر: ۶۰۲۸۱
تاریخ انتشار: ۲۶ فروردين ۱۴۰۴ - ۱۳:۲۹

همه چیز درباره هوش مصنوعی جدید «اوپن‌ای‌آی»

«اوپن‌ای‌آی» روز دوشنبه خانواده جدیدی از مدل‌های هوش مصنوعی خود را به نام «GPT-۴.۱» معرفی کرد که تمرکز آن بر کدنویسی است.
همه چیز درباره هوش مصنوعی جدید «اوپن‌ای‌آی»

مخاطب۲۴- هوش مصنوعی- «اوپن‌ای‌آی» (OpenAI) در حال حاضر مدل‌های «GPT-۴.۱»، «GPT-۴.۱ mini» و «GPT-۴.۱ nano» را دارد که برتری خود را در کدنویسی و دنبال کردن دستورالعمل‌ها نشان داده‌اند. مدل‌های چندوجهی که از طریق API اوپن‌ای‌آی در دسترس هستند، می‌توانند هر بار تقریبا یک میلیون توکن (۷۵۰ هزار کلمه) را دریافت کنند. این میزان کلمه، یک متن طولانی‌تر از رمان «جنگ و صلح» را تشکیل می‌دهد.

GPT-۴.۱ زمانی وارد شده است که رقبای اوپن‌ای‌آی مانند «گوگل» و «آنتروپیک» تلاش‌های خود را برای ساخت مدل‌های برنامه‌نویسی پیچیده افزایش می‌دهند. «جمینای ۲.۵ پرو» (Gemini ۲.۵ Pro) که اخیرا توسط گوگل منتشر شد و یک میلیون توکن را پوشش می‌دهد، رتبه بالایی را در معیار‌های محبوب کدنویسی دارد. «کلود ۳.۷ سونت» (Claude ۳.۷ Sonnet) و «V۳» ارتقاءیافته شرکت چینی «دیپ‌سیک» (DeepSeek) نیز همین طور هستند.

بیشتر بخوانید

هدف بسیاری از غول‌های فناوری از جمله اوپن‌ای‌آی، آموزش دادن مدل‌های کدنویسی هوش مصنوعی است که می‌توانند وظایف پیچیده مهندسی نرم‌افزار را انجام دهند. «سارا فریار» (Sarah Friar)، مدیر ارشد مالی اوپن‌ای‌آی ماه گذشته در نشست فناوری لندن گفت که جاه‌طلبی بزرگ این شرکت، ایجاد یک مهندس نرم‌افزار عاملی است. این شرکت ادعا می‌کند که مدل‌های آینده آن می‌توانند همه برنامه‌ها را به صورت سرتاسری برنامه‌ریزی کنند و بر جنبه‌هایی مانند تضمین کیفیت، آزمایش مشکل و نوشتن مستندات مدیریت داشته باشند.

مدل GPT-۴.۱ گامی در این مسیر است. یکی از سخن‌گویان اوپن‌ای‌آی در یک ایمیل به تک کرانچ، گفت: ما GPT-۴.۱ را برای استفاده در دنیای واقعی بر اساس بازخورد مستقیم تنظیم کرده‌ایم تا در زمینه‌هایی که توسعه‌دهندگان بیشتر به آنها اهمیت می‌دهند مانند برنامه‌نویسی فرانت‌اند، کاهش ویرایش‌های اضافی، فرمت‌های قابل اعتماد، رعایت ساختار پاسخ و سفارش، استفاده ثابت از فناوری و موارد دیگر بهبود پیدا کنیم. این پیشرفت‌ها توسعه‌دهندگان را قادر می‌سازند تا عواملی را ارائه دهند که در کار‌های مهندسی نرم‌افزار در دنیای واقعی به طور قابل توجهی بهتر باشند.

اوپن‌ای‌آی ادعا می‌کند که مدل کامل GPT-۴.۱ از مدل‌های GPT-۴o و GPT-۴o mini در معیار‌های کدنویسی مانند «SWE-bench» بهتر عمل می‌کند. گفته می‌شود که GPT-۴.۱ mini و nano با کمی دقت، کارآمدتر و سریع‌تر عمل می‌کنند و GPT-۴.۱ nano سریع‌ترین و ارزان‌ترین مدل آن است.

مدل GPT-۴.۱ برای هر میلیون توکن ورودی، دو دلار و برای هر میلیون توکن خروجی، هشت دلار هزینه دارد. هزینه GPT-۴.۱ mini برای هر میلیون توکن ورودی ۰.۴۰ دلار و برای میلیون توکن خروجی ۱.۶۰ دلار است و GPT-۴.۱ nano برای هر میلیون توکن ورودی ۰.۱۰ دلار و برای هر میلیون توکن خروجی ۰.۴۰ دلار هزینه دارد.

آزمایش داخلی اوپن‌ای‌آی نشان می‌دهد GPT-۴.۱ که می‌تواند هم‌زمان توکن‌های بیشتری را نسبت به GPT-۴o تولید کند (۳۲۷۶۸ در مقابل ۱۶۳۸۴)، امتیازی بین ۵۲ تا ۵۴.۶ درصد در پایگاه داده «SWE-bench Verified» کسب کرده است. اوپن‌ای‌آی در یک پست وبلاگ خاطرنشان کرد که برخی از راه‌حل‌ها برای مشکلات SWE-bench Verified را نمی‌توان در زیرساخت‌های آن اجرا کرد و به همین دلیل، این دامنه امتیاز‌ها وجود دارند. این ارقام کمی کمتر از امتیازات گزارش‌شده توسط گوگل و آنتروپیک برای جمینای ۲.۵ پرو (۶۳.۸ درصد) و کلود ۳.۷ سونت (۶۲.۳ درصد) هستند.

اوپن‌ای‌آی در یک ارزیابی جداگانه، GPT-۴.۱ را با استفاده از «Video-MME» بررسی کرد که برای ارزیابی توانایی یک مدل در درک محتوای ویدئو‌ها طراحی شده است. اوپن‌ای‌آی ادعا می‌کند که GPT-۴.۱ به دقت ۷۲ درصدی در مقوله ویدئو‌های طولانی و بدون زیرنویس رسیده است.

اگرچه GPT-۴.۱ امتیاز قابل قبولی را در معیار‌ها کسب کرده و دارای یک رکورد جدیدتر در آموزش داده است، اما به خاطر داشته باشید حتی برخی از بهترین مدل‌های امروزی در حال دست‌وپنجه نرم کردن با وظایفی هستند که متخصصان را غافلگیر نمی‌کنند. به عنوان مثال، بسیاری از پژوهش‌ها نشان داده‌اند که مدل‌های تولیدکننده کد اغلب در رفع و حتی معرفی آسیب‌پذیری‌ها و مشکلات امنیتی شکست می‌خورند.

همچنین، اوپن‌ای‌آی تصدیق می‌کند که GPT-۴.۱ هر چه توکن‌های ورودی بیشتری داشته باشد، کمتر قابل اعتماد می‌شود؛ یعنی احتمال بروز اشتباه افزایش می‌یابد. در یکی از آزمایش‌های خود اوپن‌ای‌آی موسوم به «OpenAI-MRCR»، دقت مدل از حدود ۸۴ درصد با ۸۰۰۰ توکن به ۵۰ درصد با یک میلیون توکن کاهش یافت. اوپن‌ای‌آی می‌گوید که GPT-۴.۱ نسبت به GPT-۴o به معنای واقعی کلمه دقیق‌تر است و گاهی اوقات به درخواست‌های مشخص‌تر و واضح‌تر نیاز دارد.

برچسب ها: هوش مصنوعی
captcha
پربحث ترین ها
پرطرفدارترین ها
اخبار داغ
راه حل وزیر ارتباطات درباره اختلالات جی‌پی‌اس راه حل وزیر ارتباطات درباره اختلالات جی‌پی‌اس
سید ستار هاشمی، وزیر ارتباطات و فناوری اطلاعات، درباره اختلالات جی‌پی‌اس گفت: گزارشی را آماده کرده‌ایم، چون فقط حوزه ارتباطات متاثر از اختلالات جی‌پی‌اس نیست، در حوزه صنعت هوانوردی با این چالش به‌صورت جدی مواجه هستیم. اختلالات جی‌پی‌اس را احصا کرده‌ایم و به شورای عالی امنیت ملی منعکس کرده‌ایم و این موضوع در دستورکار قرار گرفته است
پاسخ مربی مشهور به پیشنهاد استقلال: من پرسپولیسی هستم! پاسخ مربی مشهور به پیشنهاد استقلال: من پرسپولیسی هستم!
سرمربی پیشین تیم فوتبال پرسپولیس پیشنهاد رقیب دیرینه این تیم را نپذیرفت.
پایان کار ساپینتو در استقلال، توافق انجام شد! پایان کار ساپینتو در استقلال، توافق انجام شد!
همان‌طور که طی ساعات گذشته و پس از حذف استقلال از لیگ قهرمانان آسیا شایعاتی پیرامون آینده ریکاردو ساپینتو منتشر شده بود، اکنون از این باشگاه خبر می‌رسد که سرانجام مدیران برای برکناری سرمربی پرتغالی به اجماع رسیده‌اند و او قرار است از سمت خود کنار گذاشته شود
نقش زیردریایی‌ کلاس غدیر ایران در جنگ احتمالی نقش زیردریایی‌ کلاس غدیر ایران در جنگ احتمالی
وقتی روی سطح آب بازیگران با عرشه های بزرگ و دید مستقیم و پرچم های افراشته حضور دارند ،در لایه‌ای پایین‌تر از سطح آب، جایی که نه پرچمی برافراشته است و نه نمایش قدرتی در کار، بازی دیگری در جریان است.
حادثه برای هواپیمای آموزشی اف۴ در همدان +عکس خلبان حادثه برای هواپیمای آموزشی اف۴ در همدان +عکس خلبان
یک فروند هواپیمای نیروی هوایی ارتش در حین اجرای ماموریت آموزشی شبانه در استان همدان دچار سانحه شد و یکی ازخلبانان این هواپیما به درجه رفیع شهادت نائل آمد و دیگر خلبان این هواپیما سالم است
فیلم+ بسته شدن تنگه هرمز برای چند ساعت فیلم+ بسته شدن تنگه هرمز برای چند ساعت
بسته شدن تنگه هرمز، فرمانده نیروی دریایی سپاه، امروز در رزمایش کنترل هوشمند تنگۀ هرمز برای رعایت اصول ایمنی و کشتی رانی، بخش‌هایی از تنگۀ هرمز برای چند ساعت بسته می‌شود.
ساعت کاری ادارات در ماه مبارک رمضان ساعت کاری ادارات در ماه مبارک رمضان
معاون سرمایه انسانی سازمان اداری و استخدامی کشور بخشنامه ساعات آغاز به کار ادارات در ماه مبارک رمضان را ابلاغ کرد.
برگزیده
باد شدید و گردوخاک در راه تهران! باد شدید و گردوخاک در راه تهران!
اداره‌کل هواشناسی استان تهران با صدور هشدار زردرنگ از افزایش وزش باد خبر داد. بر اساس این هشدار، وزش باد نسبتا شدید تا شدید در بعضی ساعت‌ها در نیمه شمالی و وزش باد شدید تا خیلی شدید و گاهی با گردوخاک در نیمه‌جنوبی و مناطق مرکزی از اوایل وقت جمعه تا عصر این روز (اول اسفند) پیش‌بینی می‌شود.
فردا پنجشنبه ۳۰ بهمن یکم ماه رمضان است فردا پنجشنبه ۳۰ بهمن یکم ماه رمضان است
ستاد استهلال دفتر رهبر انقلاب: هلال ماه رمضان رؤیت شد، فردا پنج‌شنبه ۳۰ بهمن، اول ماه مبارک رمضان است
سقف پاداش پایان خدمت بازنشستگان مشخص شد سقف پاداش پایان خدمت بازنشستگان مشخص شد
نمایندگان مجلس در جلسه علنی صبح امروز (دوشنبه ۲۷ بهمن ماه) مجلس و در جریان بررسی ردیف ۱ الزامات مصارف لایحه بودجه ۱۴۰۵ مربوط به حقوق و مزایای کلیه دستگاه، مصوباتی داشتند.