اخبار تکنولوژیاخبار هوش مصنوعی

GLM-۵.۳ معرفی شد؛ جهش ۵۰ درصدی در کدنویسی و توانایی‌های ایجنتی

شرکت Z.ai از مدل هوش مصنوعی جدید GLM-5.3 رونمایی کرده است؛ مدلی که به‌عنوان جدیدترین نسخه پرچم‌دار این شرکت معرفی شده و تمرکز اصلی آن روی مهندسی نرم‌افزار پیچیده، برنامه‌نویسی و انجام وظایف ایجنتی است. طبق اعلام Z.ai، GLM-5.3 در بنچمارک داخلی Z.ai Code Bench حدود ۵۰ درصد عملکرد بهتری نسبت به GLM-5.2 ارائه می‌دهد.

نکته قابل توجه این است که GLM-5.3 برخلاف یک نسل کاملاً جدید، از همان مدل پایه GLM-5.2 استفاده می‌کند و بیشتر پیشرفت‌های آن حاصل Post-Training یا آموزش پس از مرحله پیش‌آموزش است. Z.ai می‌گوید این مدل در بنچمارک‌هایی مانند Terminal-Bench 3.0 و Agents’ Last Exam نیز به نتایج سطح بالایی در میان مدل‌های متن‌باز دست پیدا کرده است.

تمرکز GLM-5.3 روی پروژه‌های پیچیده نرم‌افزاری

یکی از مهم‌ترین ویژگی‌های GLM-5.3 توانایی آن در مدیریت پروژه‌های طولانی و پیچیده است. این مدل می‌تواند روی پروژه‌هایی شامل ده‌ها هزار خط کد، صدها فایل و چندین سیستم وابسته به یکدیگر کار کند و وظایفی مانند توسعه رابط کاربری، رفع باگ و بازنویسی کد را با دخالت کمتر کاربر انجام دهد.

Z.ai برای آموزش این مدل تنها به مسائل ساده برنامه‌نویسی اکتفا نکرده و فرایندهایی مانند شناسایی مشکل، تحلیل راه‌حل، پیاده‌سازی، آزمایش و تحویل نهایی را در آموزش آن در نظر گرفته است. به‌ گفته شرکت، برخی از این وظایف از نظر حجم کار با چند روز فعالیت یک مهندس نرم‌افزار ارشد برابری می‌کنند.

پیشرفت قابل توجه در بنچمارک‌های برنامه‌نویسی

GLM-5.3 در چندین آزمون عملکرد بهتری نسبت به نسل قبلی خود نشان داده است. برای مثال، امتیاز این مدل در Terminal-Bench 3.0 از ۴.۶ به ۲۸.۳ و در DeepSWE v1.1 از ۴۶.۲ به ۶۶.۹ افزایش یافته است. امتیاز GLM-5.3 در Agents’ Last Exam نیز از ۲۳.۸ به ۲۸.۵ رسیده است.

این مدل تنها روی برنامه‌نویسی تمرکز ندارد و در آزمون GDPval-AA v2 که ۴۴ حوزه شغلی را بررسی می‌کند، امتیاز ۱۷۶۹ را به‌دست آورده است. این نتیجه نشان می‌دهد Z.ai تلاش کرده توانایی‌های GLM-5.3 را به وظایف حرفه‌ای فراتر از کدنویسی نیز گسترش دهد.

قدرتمندتر در امنیت سایبری

یکی دیگر از بخش‌های قابل توجه GLM-5.3، عملکرد آن در حوزه امنیت سایبری است. طبق اطلاعات Z.ai، این مدل در CyberGym به امتیاز ۸۴.۵ درصد رسیده و در زمینه کشف آسیب‌پذیری عملکرد قدرتمندی دارد. همچنین امتیاز آن در ExploitBench از ۲۴.۴ درصد در نسل قبلی به ۵۴.۴ درصد افزایش یافته است.

البته Z.ai تأکید می‌کند که برتری GLM-5.3 در حال حاضر بیشتر به مراحل ابتدایی زنجیره کشف و بررسی آسیب‌پذیری مربوط می‌شود و این مدل همچنان برای انجام فرایندهای عمیق‌تر بهره‌برداری و سناریوهای کامل تهاجمی و دفاعی جای پیشرفت دارد.

پشتیبانی از کانتکست یک میلیون توکنی

GLM-5.3 از کانتکست یک میلیون توکن پشتیبانی می‌کند و حداکثر خروجی آن به ۱۲۸ هزار توکن می‌رسد. این ظرفیت بالا می‌تواند برای تحلیل پروژه‌های بزرگ، بررسی حجم زیادی از کد و انجام مکالمات طولانی با مدل کاربردی باشد.

این مدل همچنین از قابلیت‌هایی مانند Thinking Mode، استریم خروجی، Function Calling، Context Caching، Structured Output و MCP پشتیبانی می‌کند؛ مجموعه‌ای از قابلیت‌ها که امکان استفاده از GLM-5.3 را در ابزارهای توسعه و سیستم‌های مبتنی بر ایجنت فراهم می‌کند.

بیشتر بخوانید: بهترین سایت‌های هوش مصنوعی ساخت موزیک در سال 2026

GLM-5.3 در دسترس برای کاربران Coding Plan

Z.ai اعلام کرده است که API مدل GLM-5.3 هنوز در حال آماده‌سازی بوده اما این مدل در حال حاضر برای کاربران GLM Coding Plan در دسترس قرار گرفته است. این سرویس برای ابزارهایی مانند Claude Code، Cline و OpenCode طراحی شده و پلن‌های مختلفی برای استفاده از مدل‌های GLM ارائه می‌دهد.

منبع:‌ docs.z.ai

مقالات مرتبط

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

دکمه بازگشت به بالا