Research·
دراسة جديدة تكشف عن سمات الكتابة المستمرة عبر نماذج اللغة الكبيرة الرائدة
يُظهر تحليل Graphite الواسع أن كل نموذج رائد يحتفظ ببصمات لغوية مميزة، من العبارات المفرطة الاستخدام إلى الصيغ التصحيحية، رغم المحاولات لجعلها تبدو أكثر إنسانية.

قامت شركة الأبحاث التسويقية Graphite بفحص 10,000 مقالة سابقة لإطلاق ChatGPT، وطلبت من عدة نماذج متطورة إعادة كتابتها من ملخصات. من خلال مقارنة تكرار العبارات بين النصوص البشرية وتلك المولدة آلياً، حدد الفريق أكثر من 13,000 تعبير تظهر بضعف المعدل على الأقل في نصوص الذكاء الاصطناعي.
أبرز سمة لنموذج Claude Opus 5.5 هي كلمة "dependable" التي تظهر 23 مرة أكثر من الكتابة البشرية. كما يفضل النموذج بناء الجملة "is more than an X, it’s a Y" ويكرر الإشارة للأهمية بعبارتي "this matters" (116 مرة) و "why X matters" (92 مرة). في المقابل، يميل نموذج Astra من OpenAI إلى استخدام "another dimension" ويحوط ادعاءاته بـ "may provide" أو "can provide"، بينما تظهر صيغته التصحيحية — "not simply X" أو "rather than relying on X" — أكثر من 100 مرة مقارنة بالنصوص البشرية.
قللت المختبرات الثلاثة استخدام الشرطة المزدوجة (em‑dash) بشكل كبير: Opus 5.5 خفضها بنسبة 99% عن سابقه، وAstra بنسبة 88% عن البشر، وGemini 3.1 Pro أزالت تقريباً تماماً. مع ذلك، يظل العدد الإجمالي للسمات المميزة ثابتاً، مما يشير إلى أن إزالة الغرائب المعروفة تكشف عن غرائب جديدة.
لماذا يهم ذلك البنية التحتية لوحدات معالجة الرسوم والذكاء الاصطناعي
يتطلب اكتشاف هذه البصمات اللغوية وقياسها تشغيل استنتاجات ضخمة عبر نماذج متنوعة، وهو عبء عمل يتناسب طردياً مع سعة وحدات معالجة الرسوم. مزودو السحابة الذين يوفرون عناقيد GPU مرنة وعالية الإنتاجية يمكنهم تمكين الباحثين من تكرار خطوط تقييم النماذج بسرعة، وتسريع دراسات المقارنة، وتقديم خدمات ذكاء اصطناعي أكثر شفافية وموثوقية.
- aigpu
- ai gpu
- ai gpu cloud
- aigpu dubai
- llm
- ai writing
- model evaluation
بقلم AiGpu Editorial · إعادة صياغة تحريرية استناداً إلى تقارير عامة (TechCrunch AI)
→ كل المقالات