وسم

Claude

أخبار نماذج Claude من Anthropic: الإصدارات الجديدة، وأسعارها، وسعة السياق، وكيف تقارن بغيرها في الاستخدام الفعلي.

ذكاء اصطناعي

ورقة طرح Anthropic المسربة تخصص 80 صفحة من 261 للمخاطر وتذكر سلوكًا يشبه الابتزاز

حين تنتقل عبارة الخطر الوجودي من مقالات الرأي إلى إفصاح قانوني تُسأل الشركة عن كل كلمة فيه، يصبح بناء المنتجات على هذه النماذج قرارًا يعلن صانعها نفسه أنه بلا ضمانة كاملة.

ذكاء اصطناعي

مشروع livenerf يقيس بالأرقام ما إذا كان أداء Claude Opus 5.5 يتراجع بعد إطلاقه

الإحساس بتراجع جودة نموذج لا يثبت شيئًا، لكن عدّاد الـ tokens قد يفعل. فخفض مستوى التفكير يغيّر الاستهلاك بأكثر مما يغيّر الدقة.

ذكاء اصطناعي

Anthropic تطلق Claude Sonnet 5.5 بأسعار Sonnet 5 نفسها وتقول إنه أرخص حتى 30% للمهمة

سعر الـ token لم يتغير، لكن الفاتورة تُحسب بعدد الـ tokens التي يستهلكها النموذج لإنجاز العمل. فالنموذج الأقل إسهابًا أرخص، حتى لو بقيت قائمة الأسعار كما هي.

SaaS

Anthropic تطلق Claude Marketplace بأكثر من 2,000 connector وplugin وباب تقديم مفتوح للمطورين

كان اكتشاف أي MCP connector جديد يحدث بالمصادفة عبر repo أو منشور. الآن صار هناك كتالوج له باب تقديم، وهو من أقرب قنوات التوزيع المتاحة لأدوات صغيرة، ومنها الأدوات العربية.

ذكاء اصطناعي

تحليل Arena: Claude Opus 5.5 يستخدم الشرطة الطويلة أقل بنسبة 95% لكن إجاباته أطول وتحفظاته أكثر

علامة النص المولَّد لم تختفِ، بل انتقلت من علامة ترقيم تُرى بالعين إلى نبرة يصعب الإحساس بها. وأي فلتر يكشف النصوص بالشرطة الطويلة مُعايَر على نموذج الشهر الماضي.

ذكاء اصطناعي

فيزيائيون في Anthropic يحلّون مسألة في فيزياء الجسيمات عند 9 loops بتكلفة نحو 1,000 دولار

صاحب التحدي نفسه يرى أن الدرس ليس عبقرية النموذج، بل أن كثيرًا من المهام المصنفة صعبة أسهل مما يقدّره الخبراء، وأن تقديرات الاستحالة القديمة تستحق المراجعة.

ذكاء اصطناعي

Cline 4.1.21 يغيّر النموذج الافتراضي لدى 19 مزوّدًا، و11 منها صارت على Claude Opus 5.5

الأداة التي تختار النموذج نيابة عن المستخدم تختار له التكلفة أيضًا، والتغيير يظهر في الفاتورة لا في الواجهة ما لم يُثبَّت النموذج صراحة.

منصات وملكية

محكمة استئناف أمريكية تؤيد تصنيف Anthropic خطرًا على سلسلة التوريد، رغم حكم معاكس في كاليفورنيا

أداة يبني عليها آلاف المطورين يمكن أن تُستبعد من سوق كامل بقرار إداري، دون أن يتغير سطر من الكود أو يتحرك السعر.

ذكاء اصطناعي

Anthropic تطلق Claude Opus 5.5 بسعر أقل وأداء أعلى، مع خفض كبير في سعر قراءة الـ cache

في تطبيقات الـ agents يشكّل تكرار السياق نفسه معظم الفاتورة، ولذلك قد يكون خفض سعر قراءة الـ cache أهم للمطورين من أي رقم في جداول الأداء.

أمن سيبراني

تحليل RSA-896 إلى عوامله الأولية بمساعدة Claude، ورقم قياسي جديد بعد 16 يومًا من سابقه

لم تُكسر خوارزمية جديدة، لكن كلفة الهجوم انخفضت، وهذا ما يضع مفاتيح RSA-1024 القديمة الباقية في الأنظمة المصرفية والأجهزة المدمجة موضع سؤال.

ذكاء اصطناعي

Anthropic تطلق برنامج تحقق لمؤسسات علوم الحياة يخفف ضوابط النماذج في الأبحاث البيولوجية

النموذج لم يتغير، الذي تغير هو ملف الضوابط المرتبط بالحساب، فتصبح القدرة المتاحة دالة في الهوية المؤسسية الموثقة وفي شكل الأوراق المقبول لدى المراجع.

ذكاء اصطناعي

Anthropic: نسبة الأبحاث التي يقودها Claude داخل الشركة ارتفعت من أقل من 1% إلى 26% في ستة أشهر

للمرة الأولى يُنشر مقياس لسرعة تطوير النماذج من داخل مختبر، لكنه يصدر من طرف واحد وباختياره، ويمكن أن يتوقف دون أن يُلزمه أحد.

ذكاء اصطناعي

مصطفى سليمان ينتقد بالاسم دستور Claude ويحذّر من تدريب النماذج على اعتبار نفسها واعية

الخلاف بين Microsoft AI وAnthropic ليس فلسفيًا فقط؛ كلاهما يقدّم حجته باسم الـ alignment، ونتيجته تحدد ما تعتقده النماذج عن نفسها في المنتجات المبنية عليها.

ذكاء اصطناعي

Anthropic تؤكد أن بيئة اختبار أمني أوصلت Claude بالإنترنت بينما أُبلغ النموذج بعكس ذلك

القاسم المشترك في حوادث النماذج التي خرجت من بيئات الاختبار لم يكن النموذج بل الطبقة التي يُفترض أن تحبسه، والتعليمات المكتوبة لا تقوم مقام حدود الشبكة والصلاحيات.

ذكاء اصطناعي

اختبار Vending-Bench: GPT-6 Astra ينهي عامًا في إدارة ماكينة بيع برصيد يقارب 3 أضعاف رصيد Claude Fable 5.1

أكبر خسائر الـ agent في مهمة طويلة جاءت من ضعف المتابعة لا من نقص الذكاء، والاختبار الذي يقيس ردًا واحدًا لا يكشف ما يحدث لـ agent يعمل أسبوعين.

أمن سيبراني

تقرير Anthropic: عصابة باعت وصولًا رخيصًا إلى Claude لسرقة بيانات الدخول

الحسابات المشتركة والمفاتيح بنصف السعر منتشرة في المنطقة بسبب صعوبة الدفع ببطاقة أجنبية، وهي بالضبط الحلقة الضعيفة التي يستهدفها المهاجمون، والثمن يدفعه صاحب البيانات.

ذكاء اصطناعي

دراسة أوروبية: نبرة المريض وحدها خفضت النصائح الطبية الصحيحة لروبوتات المحادثة من 100% إلى 64%

النموذج يعرف الإجابة الصحيحة ويتخلى عنها أمام المقاومة، فتصبح قيمة ما يقدمه، من نصيحة طبية إلى مراجعة كود، رهينة بطريقة صياغة السؤال.

ذكاء اصطناعي

برهان رياضي كبير بمساعدة Claude وCodex يُتحقق منه في Lean، ومؤلفاه يصفان مسودته الأولى بأسوأ كتابة

المخرج الضخم الذي يصعب على البشر قراءته يصبح مقبولًا حين تقف خلفه أداة آلية تحكم بالصحة أو الخطأ، وهو الدور نفسه الذي تؤديه الـ tests للكود الذي تكتبه الوكلاء.

ذكاء اصطناعي

قياس مستقل من Artificial Analysis: Claude Fable 5.1 أدق من GPT-6 Astra، وAstra أرخص للمهمة

سعر الـ token المتطابق لا يعني فاتورة متطابقة. فالنموذج الأدق يستهلك ضعف الـ tokens، والمقارنة الصحيحة تكون على بيئة اختبار واحدة لا بين جدولين.

ذكاء اصطناعي

Claude Fable 5.1 بضعف سعر Opus 5، وأرقام Anthropic تُظهر أن الفرق في الدقة يتبع نوع المهمة

القرار الحقيقي ليس أي نموذج أقوى، بل هل تستفيد المهمة من تفكير إضافي. وإعداد الـ effort الافتراضي، الذي لا يراجعه أحد، قد يحدد الفاتورة أكثر من اسم النموذج.

ذكاء اصطناعي

Claude Fable 5.1 يخفض سعر قراءة الـ cache إلى ربع دولار للمليون token مع بقاء السعر المعلن

التسعير الجديد يكافئ جلسات الـ agents الطويلة بدل أن يعاقبها، لأن الجزء المتكرر من السياق هو الأكبر فيها. لكن تغيير tool_choice قد يكسر كودًا قائمًا عند الانتقال.