Ox-Alpha، مدلی بدون نام که تنها با برچسب “stealth/ox-alpha” مشخص شده است، در تاریخ ۲۰ اوت ۲۰۲۶ در OpenRouter ظاهر شد. این مدل پنجره بافت (context window) با ظرفیت ۱,۰۴۸,۵۷۶ توکن، ورودی ویدیو و یک پیش‌نمایش رایگان ارائه می‌دهد که در ۲۷ اوت به پایان می‌رسد؛ این فرصت از توسعه‌دهندگان دعوت می‌کند تا قابلیتی را آزمایش کنند که می‌تواند کل یک پایگاه کد (codebase) یا چندین رمان را در یک درخواست واحد ببلعد.

OpenRouter به قطبی برای مدل‌های آزمایشی تبدیل شده است که بدون نام تجاری شرکت‌ها ظاهر می‌شوند و اغلب با برچسب “stealth” مشخص می‌گردند. فرآیند انتشار کم‌هزینه و بی‌دردسر این پلتفرم به پژوهشگران و آزمایشگاه‌ها اجازه می‌دهد تا نمونه‌های اولیه را تحت یک برچسب عمومی منتشر کنند و از ساختارهای معمول برندینگ و پشتیبانی عبور کنند. Ox-Alpha نیز از همین الگو پیروی می‌کند و به نسخه‌های ناشناس قبلی مانند Pony Alpha و Hunter Alpha می‌پیوندد که بعدها مشخص شد متعلق به آزمایشگاه‌های تحقیقاتی چینی هستند.

چرا پنجره توکن اهمیت دارد

اکثر مدل‌های زبانی بزرگ (LLMs) تجاری، ظرفیت بافت خود را در حدود ۸ هزار توکن محدود می‌کنند. یک پنجره‌ی یک میلیون توکنی، حجم داده‌هایی را که می‌توان به مدل داد، تا یک مرتبه بزرگی (order of magnitude) افزایش می‌دهد. در عمل، توسعه‌دهندگان می‌توانند:

  • یک مخزن نرم‌افزاری کامل را کپی کرده و درخواست بازسازی کد (refactoring) در میان فایل‌های مختلف را بدهند،
  • یک نسخه خطی کامل را به مدل داده و درخواست خلاصه‌سازی فصل‌به‌فصل کنند،
  • متن و فریم‌های ویدیو را برای تحلیل طراحی رابط کاربری (UI) یا باگ‌های بصری ترکیب کنند.

این مدل همچنین ویدیو را به عنوان یک ورودی درجه‌یک (first-class input) می‌پذیرد؛ ویژگی‌ای که هنوز در میان LLMها که معمولاً بر تصاویر ایستا یا شبکه‌های مجزای مخصوص ویدیو تکیه دارند، نادر است.

سیگنال‌های اولیه عملکرد

پژوهشگری که بنچمارک DeepSWE را اجرا کرد — مجموعه‌ای که توانایی کدنویسی را در چندین زبان ارزیابی می‌کند — امتیاز ۸۰ درصدی را ثبت کرد. این بنچمارک Ox-Alpha را مستقیماً با مدل‌های تثبیت‌شده‌ای مانند GPT-5.6 یا Claude Opus 5 مقایسه نمی‌کند، اما این نتیجه نشان‌دهنده توانمندی بالا در وظایف برنامه‌نویسی است.

در یک تست جریان کاری عامل‌محور (agentic workflow) مجزا، این مدل ۶۹ فراخوانی ابزار (tool call) انجام داد و تنها یک خطا داشت. این تست میزان قابلیت اطمینان را هنگام هماهنگ‌سازی APIهای خارجی اندازه‌گیری کرد؛ معیاری کلیدی برای دستیارهای خودمختار که نیاز دارند بدون نظارت انسانی، زنجیره‌ای از اقدامات را انجام دهند.

چه کسی ممکن است پشت آن باشد؟

هیچ سازمانی مالکیت آن را ادعا نکرده است، اما بررسی‌های فنی (forensics) به ارتباط احتمالی با سری منتشرنشده GLM-5.x متعلق به Zhipu AI اشاره دارند. شواهد شامل موارد زیر است:

  • الگوهای کدگذاری ویدیو که با الگوهای استفاده شده در مدل‌های شناخته‌شده GLM مطابقت دارند،
  • رفتار توکنایزر (tokenizer) که با مجموعه توکن‌های GLM-5.3 همسو است،
  • سبک متمایز استفاده از ایموجی که در نسخه‌های قبلی GLM دیده شده است.

اگر این انتساب درست باشد، Ox-Alpha نشان‌دهنده جهشی از نمونه‌های اولیه داخلی Zhipu به یک سرویس در دسترس عموم خواهد بود که یادآور نسخه‌های «مخفیانه» قبلی است که در نهایت منشأ چینی خود را فاش کردند.

آنچه توسعه‌دهندگان می‌توانند به دست آورند

  • تحلیل کد در مقیاس بزرگ – اجرای تحلیل ایستا (static analysis) یا بازسازی کد (refactoring) در هزاران فایل بدون نیاز به تکه‌تکه کردن ورودی.
  • کدنویسی با بافت بصری – ترکیب فریم‌های ویدیو با تولید کد برای اتوماسیون رابط کاربری (UI) یا اسکریپت‌های ویرایش ویدیو.
  • جریان‌های کاری با بافت طولانی – ساخت عامل‌هایی (agents) که حافظه خود را در تعاملات طولانی حفظ می‌کنند، که برای دستیارهای پژوهشی یا تولید روایت مفید است.

ریسک‌ها و موارد ناشناخته

  • عدم وجود مستندات – مدل فاقد راهنماهای رسمی است که فرآیند یکپارچه‌سازی را به یک فرآیند آزمون و خطا تبدیل می‌کند.
  • عدم پشتیبانی یا توافق‌نامه‌های سطح خدمات (SLA) – هرگونه قطعی یا رفتار غیرمنتظره بر عهده کاربر است.
  • قیمت‌گذاری – مدل در طول دوره پیش‌نمایش که در ۲۷ اوت به پایان می‌رسد، رایگان است.

جمع‌بندی

Ox-Alpha نشان می‌دهد که قابلیت‌های هوش مصنوعی قدرتمند با بافت طولانی می‌توانند یک‌شبه ظاهر شوند و از ساختارهای سنتی برندینگ و پشتیبانی عبور کنند. برای توسعه‌دهندگان، این مدل یک میان‌بر وسوسه‌انگیز برای وظایفی است که پیش از این نیاز به خط لوله‌های (pipelines) سفارشی داشتند، اما فقدان منشأ مشخص، مستندات و خدمات تضمین‌شده، نیازمند رویکردی محتاطانه است. هفته پیش رو مشخص خواهد کرد که آیا معمای پشت Ox-Alpha به یک ابزار پایدار تبدیل می‌شود یا به عنوان یک آزمایش گذرا باقی می‌ماند.