Skip to main content

جروك 4.7 متوفر الآن في Felo Search: إجابات طويلة الأمد، $2/$6

· 7 دقائق
Felo Search Tips Buddy
Committed to answers at your fingertips

جروك 4.7 متوفر في Felo Search: سياق 500 ألف، $2/$6 لكل مليون رمز، واستدلال طويل الأمد مصمم للأبحاث التي تستغرق ساعات.

أطلقت SpaceXAI جروك 4.7 في 21 سبتمبر، وصُمم لنوع محدد من الأسئلة: السؤال الذي يحتاج ساعة من البحث وليس مجرد نظرة واحدة. النموذج متاح الآن في Felo Search، إلى جانب ثلاثة نماذج أخرى وصلت في نفس الأسبوع.

الرقم الرئيسي يظهر في جانب المخرجات. جروك 4.7 يكلف $2 لكل مليون رمز إدخال و$6 لكل مليون رمز إخراج، بنفس سعر جروك 4.6 بينما يزعم المزود ضعف سرعة النماذج المماثلة. إجابة البحث في Felo ليست مجرد استدعاء نموذج واحد. النموذج يقرأ المصادر، ويقارنها ببعضها، ويكتب التركيب، ويعود عندما تظهر اختلافات. سعر الإخراج يمثل التكلفة الفعلية لتحقيق طويل الأمد.

جروك 4.7 في Felo Search: نافذة سياق 500 ألف رمز في مهمة بحث طويلة الأمد

ما هو جروك 4.7 فعلاً​

تقدم SpaceXAI (الشركة المعروفة سابقاً باسم xAI) جروك 4.7 كنموذجها "الأقوى للبرمجة والعمل المعرفي". الجزء المهم في هذا الوصف هو النصف الثاني. ركزت الإصدارات الثلاثة السابقة من جروك على البرمجة؛ هذا النموذج تدرب بجلسة تعزيز أطول موجهة نحو مهام تستغرق عدة ساعات للإنجاز.

هذا التدريب يظهر في جانبين يمكن ملاحظتهما من مربع البحث: التحقق الذاتي وإدارة السياق الطويل. النموذج تدرب على مراجعة عمله الوسيط بدلاً من الالتزام بأول مسار ممكن، وعلى تتبع ما أثبته قبل عشرين خطوة.

المواصفةجروك 4.7
معرف النموذجgrok-4.7
الشركة المصنعةSpaceXAI
تاريخ الإصدار21 سبتمبر 2026
نافذة السياق500,000 رمز
الإدخالنص، صورة
الإخراجنص
جهد الاستدلالمنخفض / متوسط / عالي (افتراضي) / عالي جداً
السعر$2 لكل مليون إدخال، $6 لكل مليون إخراج
الإدخال المؤقت$0.50 لكل مليون رمز
حد المعرفةيونيو 2026، مع تدريب إضافي حتى أغسطس 2026

نافذة السياق 500,000 رمز هي الأصغر بين النماذج الأربعة التي وصلت هذا الأسبوع. لكنها تفي بالغرض لمهام البحث: مئة مستند طويل، ربع كامل من تقارير الأرباح، أو سلسلة بحثية كاملة مع كل مصدر في السياق. النوافذ الأكبر مهمة عندما يحتاج النموذج للاحتفاظ بمستودع أو سنة كاملة من التوثيق دون خطوة استرجاع. هذا ينطبق على نماذج المليون رمز في الجدول أدناه.

لماذا هذا مهم لبحث الذكاء الاصطناعي​

إجابة البحث تواجه نوعين من الفشل. الأول عدم إيجاد المصدر. الثاني إيجاد المصدر، وسوء فهمه، وذكر الفهم الخاطئ بثقة. النوع الثاني أسوأ، لأنه يبدو كإجابة صحيحة.

التدريب طويل الأمد يهاجم النوع الثاني من الفشل. عندما يحصل النموذج على مكافأة لإنهاء مهام تستغرق ساعات بشكل صحيح، تتوقف الاستراتيجيات السهلة عن العمل. مطابقة الأنماط مع أول مستند ممكن، تجاهل مصدر يناقض الإجابة الناشئة، إسقاط قيد تم وضعه مبكراً: كل هذه الاستراتيجيات لا تنجح في مهمة تستمر لساعات. ما يبقى من هذا التدريب هو عادة العودة والتحقق.

نتائج جروك 4.7 المنشورة تشير إلى نفس الاتجاه. في GDPval، الذي يقيس جودة التسليم المهني الواقعي، أبلغ المزود عن Elo بقيمة 1,695، ارتفاعاً من 1,605 لجروك 4.6. في AA Briefcase v1.1، وهو معيار للعمل المعرفي، انتقل من 1,546 إلى 1,657. HealthBench Professional ارتفع من 48.5% إلى 56.7%، وHarvey Legal Agent Benchmark من 15.8% إلى 19.6%.

هذه أرقام من المزود، تم تقييمها في إعدادات جهد مختلفة وأدوات مختلفة، لذا يجب اعتبارها ادعاءً وليس نتيجة. المقارنة الجديرة بالثقة هي داخل نفس العائلة: 4.7 يتفوق على 4.6 باستمرار في الأعمال التي تشبه البحث.

1. افتح قائمة اختيار النماذج. ابدأ بحثاً في Felo واختر جروك 4.7. لا يتغير شيء آخر في سير عملك: نفس المربع، نفس المصادر، نفس مساحة العمل.

2. اطرح السؤال الذي كنت ستقسمه عادة إلى أربعة. النماذج طويلة الأمد تبرر سعرها في الطلبات الغامضة متعددة القيود. بدلاً من "ما هو الجدول الزمني لقانون الذكاء الاصطناعي الأوروبي" جرب "ما هي التزامات قانون الذكاء الاصطناعي الأوروبي التي تطبق أولاً على شركة تبيع نموذجاً عاماً في الاتحاد الأوروبي، وأي منها لديها إرشادات تنفيذية منشورة حتى الآن." سؤال واحد، عدة أسئلة فرعية.

3. دع النموذج يختلف مع نفسه. تابع بسؤال "أين تتعارض مصادرك في هذا، وأيها أكثر موثوقية؟" النموذج المدرب على التحقق الذاتي يتعامل مع هذا التحدي أفضل من النموذج المدرب على إنتاج إجابة واحدة واثقة.

4. غيّر مستوى الجهد عندما يتغير شكل السؤال. جروك 4.7 يوفر أربعة إعدادات لجهد الاستدلال. المستوى المتوسط يغطي البحث العادي؛ ارفعه عندما يحتوي السؤال على سلسلة طويلة من الاعتماديات، وخفضه عند تلخيص شيء تثق به بالفعل.

5. ادفع الإجابة للأمام. نفس نافذة السياق تحتفظ بالبحث والنتيجة. اطلب المذكرة، أو مخطط العرض، أو البريد الإلكتروني. المادة المصدرية تبقى أمام النموذج.

جروك 4.7 لم يصل وحده. أربعة نماذج متقدمة تم إطلاقها خلال ست وثلاثين ساعة تقريباً، وجميعها تعمل الآن في Felo Search.

النموذجمنالسعر لكل مليون رمزالسياقمخصص لـ
جروك 4.7SpaceXAI$2 إدخال / $6 إخراج500Kاستدلال طويل الأمد والعمل المعرفي
Claude Opus 5.5Anthropic$4 إدخال / $20 إخراج1Mإجابات تصمد أمام التحقق
GPT-6 LunaOpenAI$0.10 إدخال / $0.50 إخراج1.05Mبحث عالي الحجم بأقل تكلفة لكل استدعاء
GPT-6 SolOpenAI$2 إدخال / $10 إخراج1.05Mحلقات الوكلاء والاستدعاءات المتكررة بسعر متوسط

الفارق بينهم يصل إلى عشرين ضعفاً في سعر الإدخال وخمسين ضعفاً في تكلفة التحقيق الكامل. اختيار النموذج لكل سؤال أصبح الآن العامل الأكبر في جودة الإجابة وكمية البحث الممكن تنفيذه.

ماذا تجرب أولاً​

سؤال بإجابة محل نزاع. اسأل عن موضوع تختلف فيه المصادر الجادة: فعالية مكمل غذائي، التكلفة الحقيقية لهجرة، تقدير حجم سوق. ثم اطلب من جروك 4.7 أن يفصل ما تتفق عليه المصادر عما يدعيه مصدر واحد فقط. هذا هو نوع المهمة التي يستهدفها التدريب طويل الأمد.

مستند تحتاج لمجادلته. الصق عقداً أو سياسة أو مواصفة واسأل عما لا يغطيه. الأسئلة حول غياب الدليل هي المكان الذي يفشل فيه النموذج الذي يتوقف عند أول قراءة ممكنة دون أن يلاحظ أحد.

مقارنة بين مصادر مختلفة. قدم له ملفين من شركتين متنافستين واطلب المقارنة التي سيجريها محلل، مع الرقم الذي يتجنبه كل منهما.

توقع مع قيود. النماذج طويلة الأمد تتعامل مع "هنا ثمانية قيود، ابحث عن خطة تحققها جميعاً" أفضل من العصف الذهني المفتوح.

جروك 4.7 متوفر اليوم في Felo Search، مع نافذة سياق 500,000 رمز، أربعة إعدادات لجهد الاستدلال، وتسعير $2/$6. يكلف نفس النموذج الذي يحل محله، مما يعني أن الترقية مجانية على مستوى الرموز.

افتح جروك 4.7 في Felo Search →


تتوفر هذه المقالة أيضًا باللغات التالية: English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.