GPT-4 بسیاری از آزمایشها رو در ۱۰ درصد بالای گروه انجام داد، در حالی که نسخه اصلی ChatGPT اغلب در ۱۰ درصد پایینی قرار میگرفت. GPT-4 که آخرین نسخه چت ربات هوش مصنوعی ChatGPT هست، میتونه در آزمونهای دبیرستان و آزمونهای حقوق با رتبهبندی ۹۰ از ۱۰۰ قبول بشه و دارای قابلیتهای پردازشی جدیدی هست که در نسخه قبلی امکانپذیر نبود.
ارقام نمرات آزمون GPT-4 در ۱۴ مارس توسط سازنده OpenAI به اشتراک گذاشته شد و نشون داد که چت جی پی تی (ChatGPT) میتونه ورودیهای تصویر، صدا و ویدیو رو به متن تبدیل کنه و «دستورالعملهای ظریفتر» رو به صورت خلاقانهتر و قابل اعتمادتر مدیریت کند.
OpenAI اضافه کرد:
“این مورد، یک آزمون شبیه سازی شده وکالت را با امتیازی در حدود ۱۰ درصد از شرکت کنندگان برتر قبول میکند. در مقابل، امتیاز GPT-3.5 حدود ۱۰ درصد پایینتر بود.”
ارقام نشون میدن که GPT-4 در امتحان LSAT نمره ۱۶۳ رو به دست آورد. طبق قوانین، دانشآموزان کالج باید در آزمون ایالات متحده قبول بشن تا در دانشکده حقوق پذیرفته بشن. نمره GPT4 اون رو در موقعیت خوبی برای پذیرش در ۲۰ دانشکده حقوق برتر قرار میده و تنها چند نمره کمتر از نمرات گزارش شده مورد نیاز برای پذیرش در دانشکده های معتبر مثل هاروارد، استنفورد، پرینستون یا ییل هست.

نسخه قبلی ChatGPT امتیاز ۱۴۹ رو در LSAT کسب کرده بود که اون رو زیر ۴۰% قرار میداد. همچنین، GPT-4 در آزمون وکالت امتیاز ۲۹۸ از ۴۰۰ رو کسب کرد – آزمونی که به دانشجویانی که به تازگی فارغ التحصیل شدن اجازه میده تا به عنوان وکیل در هر حوزه قضایی ایالات متحده فعالیت کنن.
نسخه قدیمی ChatGPT در این آزمون با مشکل مواجه شد و با امتیاز ۲۱۳ از ۴۰۰ در رده ۱۰ درصد پایین قرار گرفت.
با قابلیتهای چت جی پی تی (ChatGPT) آشنا شوید
در مورد آزمون های SAT Evidence-based Reading & Writing و SAT Math که توسط دانش آموزان دبیرستانی ایالات متحده برای اندازه گیری آمادگی دانشگاهی اونها گرفته شده، GPT-4 به ترتیصب نمرههای ۹۳ و ۸۹ امتیاز کسب کرد.
GPT-4 در علوم پایه هم سرآمد بود، و نمرات بسیار بالایی بدست آورد. در Biology حدود ۸۵ تا ۱۰۰ درصد، در شیمی ۷۱-۸۸ درصد و در فیزیک ۲ حدود ۶۶ تا ۸۴ درصد. با این حال، امتیاز حساب AP اون نسبتاً متوسط بود و از ۱۰۰ حدود ۴۳ تا ۵۹ رو کسب کرد.

یکی دیگه از زمینههایی که GPT-4 در اون ناموفق بود، امتحانات ادبیات انگلیسی بود که نمرات ۸ تا ۴۴ رو در دو آزمون جداگانه بدست آورد.
OpenAI گفت که GPT-4 و GPT-3.5 این تست ها رو در آزمونهای عملی ۲۰۲۲-۲۰۲۳ انجام دادن و “هیچ آموزش خاصی” توسط ابزارهای پردازش زبان انجام نشده:
” ما هیچ آموزش خاصی برای این امتحانات انجام ندادیم. اقلیتی از مشکلات در امتحانات توسط مدل در طول آموزش دیده شد، اما ما معتقدیم که نتایج معرف است.”

البته باید بگیم که این نتايج باعث ترس در جامعه توییتر هم شد.
Nick Almond، بنیانگذار FactoryDAO، در ۱۴ مارس به ۱۴۳۰۰ دنبال کننده توییتر خودش گفت که:
GPT4 “مردم را میترساند و سیستم آموزشی جهانی را فروپاشی خواهد کرد.”
او در ادامه در ۱۴ مارس ۲۰۲۳ گفت:
” تئوری ارزیابی برای چندین سال بخش بزرگی از زندگی من بود. من سالها پیش به این روز فکر می کردم. من در آن زمان حرف من به معنای واقعی کلمه عجیب به نظر میرسید! این بدان معنی است که از این نقطه به بعد هر چیزی به جز ارزیابی نادیده گرفته شده به پایان رسیده است. “
Conor Grogan، مدیر سابق Coinbase گفت که او یک قرارداد هوشمند اتریوم زنده رو در GPT-4 وارد کرده ، و چت بات خیلی سریع به چندین « نقطه آسیبپذیر امنیتی» اشاره کرد و نحوه سوء استفاده از کد mighbe رو توضیح داد:
من یک قرارداد زنده از جامعه اتریوم را در GPT-4 قرار دادم. در یک لحظه، تعدادی از آسیبپذیریهای امنیتی را برجسته کرد و به مناطق سطحی اشاره کرد که میتوان از قرارداد بهرهبرداری کرد. سپس روش خاصی را تأیید کرد که من می توانم از قرارداد سوء استفاده کنم.”
ممیزی های قبلی قرارداد هوشمند در چت جی پی تی (ChatGPT) نشون داد که نسخه اول اون هم قادر به شناسایی اشکالات کد تا حد معقولی هست.
Rowan Cheung، بنیانگذار خبرنامه هوش مصنوعی The Rundown، ویدیویی از GPT به اشتراک گذاشت که یک وب سایت جعلی رو که با دست طراحی شده بود روی یک تکه کاغذ به صورت کد رونویسی میکنه. تو در ۱۴ مارس در توییتر اعلام کرد:
” من به تازگی تماشا کردم که GPT-4 یک طرح دستی را به یک وب سایت کاربردی تبدیل می کند. این دیوانه کننده است!”
منبع:
ChatGPT v4 aces the bar, SATs and can identify exploits in ETH contracts