Mercury ۲ چیست و چرا اهمیت دارد؟
شرکت Inception Labs روز پنجشنبه از Mercury ۲ رونمایی کرد و آن را سریعترین مدل زبانی استدلالی جهان معرفی نمود. این مدل توانایی تولید حدود ۱۰۰۰ توکن در ثانیه را دارد؛ در مقایسه با تقریباً ۸۹ توکن در ثانیه برای Claude Haiku ۴.۵ و ۷۱ توکن در ثانیه برای GPT-۵ Mini شرکت OpenAI. این یعنی Mercury ۲ عملاً ۱۰ تا ۱۴ برابر سریعتر از رقبای اصلیاش کار میکند.
رمز سرعت: فناوری Diffusion به جای روش سنتی
مدلهای سنتی متن را کلمهبهکلمه تولید میکنند؛ یک کلمه مینویسند، بررسی میکنند، سپس کلمه بعدی را اضافه میکنند. اما مدلهای Diffusion یک بلوک از متن را با توکنهای تصادفی پر میکنند و در چند پاس موازی، آن تصادفیبودن را پاک میکنند — همان تکنیکی که در مولدهای تصویری مثل Stable Diffusion بهکار میرود — تا کل پاسخ بهیکباره شکل بگیرد.
نبرد بنچمارکها: Mercury ۲ در برابر DiffusionGemma گوگل
در بنچمارک AIME ۲۰۲۶ (مسائل واقعی المپیاد ریاضی آمریکا)، Mercury ۲ امتیاز ۹۰٪ کسب کرد. DiffusionGemma گوگل همین آزمون را با امتیاز ۶۹.۱٪ پشت سر گذاشت، در حالی که حتی مدل استاندارد Gemma ۴ هم تنها ۸۸.۳٪ گرفت.
هوش مصنوعی، امنیت کریپتو را ارزانتر، سریعتر و غیرقابلچشمپوشی میکند: 🚀 Mercury ۲ ؛ سریعترین هوش مصنوعی دنیا که گوگل را شکست داددر بنچمارک GPQA (علم سطح دکترا)، دو مدل به هم نزدیکتر شدند: Mercury ۲ با ۷۷٪ در برابر DiffusionGemma با ۷۳.۲٪. با این حال، راهنمای توسعهدهندگان خود گوگل توصیه میکند که برای بیشترین کیفیت، از Gemma ۴ استاندارد استفاده شود و به این ترتیب اذعان میکند که DiffusionGemma در همه معیارها پایینتر از آن است.
آزمون دنیای واقعی: ۸۲٪ کاهش تأخیر!
شرکت Augment Code، فعال در حوزه عاملهای کدنویسی هوش مصنوعی، پس از جایگزینی Mercury ۲ به جای Claude Opus ۴.۷ در زیرعامل Context Compaction خود، شاهد ۸۲٪ کاهش تأخیر و ۹۰٪ کاهش هزینه بود، در حالی که کیفیت خروجی یکسان باقی ماند.
پشت این پروژه چه کسانی هستند؟
Inception Labs توسط Stefano Ermon، استاد دانشگاه استنفورد و از پیشگامان تکنیکهای Diffusion، بنیانگذاری شده است. راند تأمین مالی ۵۰ میلیون دلاری این استارتاپ با حمایت بازوی سرمایهگذاری انویدیا و سرمایهگذاران انفرادی همچون Andrew Ng و Andrej Karpathy همراه بوده است.
کاربردهای عملی: کجا از Mercury ۲ استفاده کنیم؟
این مدل برای این موارد ایدهآل است:
- کدنویسی لحظهای (Vibe Coding): هوش مصنوعی با سرعت تایپ شما همراه میشود
- سیستمهای چند-عاملی: زیرعاملهای سریع و ارزان برای وظایف تکراری
- رابطهای صوتی: بدون هیچ تأخیر آزاردهندهای
- تکمیل خودکار: پیشبینی اقدام بعدی با تأخیر بسیار پایین
📌 نکته مهم: Mercury ۲ یک مدل پولی و بسته (Closed-Weight) است که از طریق API ارائه میشود. DiffusionGemma گوگل رایگان و متنباز روی Hugging Face است؛ اما همانطور که اعداد نشان میدهند، رایگان بودن همیشه به معنای بهتر بودن نیست.
سلام تست