حافظه مطبوعاتی کویت آخرین اخبار
alanbaاخبار عمومی

«کلود» در برابر «چت‌جی‌پی‌تی»؛ کدام دستیار هوش مصنوعی برای شما مناسب‌تر است؟

«کلود» در برابر «چت‌جی‌پی‌تی»؛ کدام دستیار هوش مصنوعی برای شما مناسب‌تر است؟

رقابت میان «چت‌جی‌پی‌تی» و «کلود» با شتاب گرفتن مسابقه شرکت‌های فناوری برای توسعه مدل‌های هوش مصنوعی دقیق‌تر و توانمندتر در انجام وظایف پیچیده، شدت می‌یابد. استفاده از این ابزارها در عرض چند سال کوتاه، از یک آزمایش صرف برای پاسخ به پرسش‌ها و نوشتن متون، به پلتفرم‌های یکپارده‌ای تبدیل شده که روزبه‌روز بیشتر در حوزه‌های کاری، تحصیلی، برنامه‌نویسی، مدیریت فایل‌ها و تولید محتوا نفوذ می‌کنند.

«چت‌جی‌پی‌تی» نخستین تجربه گسترده‌ای بود که میلیون‌ها کاربر با مدل‌های زبانی بزرگ داشتند؛ پس از آنکه «اوپن‌ای‌آی» آن را در سال ۲۰۲۲ عرضه کرد و به‌سرعت توانست با بهره‌گیری از حضور زودهنگام در بازار، مخاطبان بسیار زیادی را جذب کند. سپس «آنتروپیک» با معرفی دستیار خود تحت عنوان «کلود» در مارس ۲۰۲۳ وارد این رقابت شد.

از آن زمان، این دو شرکت در مسابقه‌ای مستمر برای توسعه مدل‌ها و افزودن ابزارها و قابلیت‌های جدید به سر برده‌اند، به‌طوری که تفاوت‌های میان این دو پلتفرم در کاربردهای روزمره کمتر محسوس شده است. هر دو قادر به پاسخگویی به پرسش‌ها، خلاصه‌سازی اسناد، نوشتن کدها، تولید محتوا و انجام بسیاری از وظایف شناختی هستند، اما تفاوت‌ها هنگام گذر به کاربردهای حرفه‌ای، تخصصی و پیچیده‌تر بیشتر نمایان می‌شوند.

آزمون‌های دقت، رقابتی بسیار نزدیک را میان قوی‌ترین مدل‌های این دو شرکت نشان می‌دهد. بر اساس معیار «دقت AA-Omniscience»، مدل Claude Fable 5 (Max) دقتی معادل ۶۱ درصد و مدل GPT-5.6 Sol (Max) دقتی ۵۹ درصد کسب کرده است؛ اختلافی تنها دو درصدی که برای کاربر عادی ممکن است محسوس نباشد. اما معادله هنگام گذر به مدل‌های میان‌رده تغییر می‌کند؛ در این سطح، «چت‌جی‌پی‌تی» با اختلاف بیشتری پیشی گرفته است. مدل GPT-5.6 Terra (Max) دقتی ۴۶ درصدی در حالی که Claude Sonnet 5 (Max) دقتی ۳۸ درصدی ثبت کرده است. این موضوع تأیید می‌کند که مقایسه را نمی‌توان به یک اعلام برتری مطلق برای یک پلتفرم تقلیل داد، بلکه به‌شدت به مدل مورد استفاده و ماهیت وظیفه بستگی دارد.

«هذیان» (Hallucination) به‌عنوان یکی از مهم‌ترین شاخص‌ها در ارزیابی قابلیت اطمینان مدل‌های هوش مصنوعی برجسته است؛ به این معنا که مدل اطلاعات یا پاسخ‌های نادرست را در صورت عدم آگاهی کافی اختراع می‌کند. در این زمینه، ارقام برتری واضحی را برای «کلود» نشان می‌دهند. بر اساس معیار «نرخ هذیان AA-Omniscience» (که در آن درصد کمتر بهتر است)، مدل Claude Fable 5 نرخ هذیان ۵۵ درصدی و مدل GPT-5.6 Sol نرخ ۸۹ درصدی ثبت کرده است.

این شکاف هنگام مقایسه مدل‌های میان‌رده گسترش می‌یابد؛ نرخ هذیان برای Claude Sonnet 5 حدود ۳۷ درصد و برای GPT-5.6 Terra برابر با ۸۵ درصد است. گزارش همچنین اشاره می‌کند که GPT-4o، که مدل قدیمی‌تری است، نرخ هذیان ۳۸ درصدی را ثبت کرده در مقابل ۸۹ درصد برای GPT-5.6 Sol؛ این امر نشان می‌دهد که پیشرفت مدل‌ها در توانایی‌های عمومی، لزوماً به معنای بهبود یکسان تمام شاخص‌های عملکرد نیست.

رقابت تنها بر سر دقت متمرکز نیست؛ «آنتروپیک» در تلاش است جایگاه «کلود» را به‌عنوان ابزاری برای کار و بهره‌وری تقویت کند. بر اساس گزارش «شاخص اقتصادی آنتروپیک» منتشر شده در مارس ۲۰۲۶، ۴۵ درصد از مکالمات «کلود» مربوط به کاربردهای کاری، ۴۲ درصد مربوط به استفاده شخصی و سهم باقی‌مانده مربوط به امور تحصیلی بوده است. در مقابل، داده‌های «اوپن‌ای‌آی» نشان می‌دهد که ۷۰ درصد از استفاده از «چت‌جی‌پی‌تی» ارتباطی با کار ندارد.

«کلود» مجموعه‌ای از ابزارها را ارائه می‌دهد که این روند را تقویت می‌کنند؛ از جمله Claude Cowork که در ژانویه ۲۰۲۶ برای انجام وظایف شناختی به‌نام کاربر و مدیریت فایل‌ها معرفی شد، همچنین قابلیت‌های Skills که امکان ایجاد بسته‌های دستورالعمل سفارشی را فراهم می‌کند و Artifacts که امکان نمایش، اشتراک‌گذاری و تعامل با کدها، صفحات HTML، اجزای تعاملی، نمودارها و تصاویر را می‌دهد.

در مقابل، «چت‌جی‌پی‌تی» در ابزارهای تعامل مستقیم، از جمله گفتگوهای صوتی طبیعی و امکان قطع کردن مدل در حین صحبت بدون از دست دادن زمینه مکالمه، و همچنین استفاده از ویدیو زنده برای دریافت کمک آنی، برجسته‌تر است. علاوه بر این، توانایی‌های آن در تولید تصاویر واقع‌گرایانه، به آن مزیت رقابتی قابل‌توجهی در کاربردهای شخصی، تولید محتوا و تعامل چندرسانه‌ای می‌بخشد.

آخرین اخبار منبع اصلی
لینک کپی شد ✓