قسم

ذكاء اصطناعي

ذكاء اصطناعي

Anthropic وOpenAI تخفضان سعر قراءة الـ cache إلى 5% من سعر الإدخال في إصداريهما الجديدين

الوكلاء الذين يعيدون قراءة السياق نفسه طوال اليوم هم أكثر من يستفيد من هذا الخفض، وأثره يظهر في الفاتورة الشهرية لا في العرض التجريبي، بينما يبقى سببه دون تأكيد رسمي.

ذكاء اصطناعي

OpenAI تطلق dots، وكلاء يعملون في السحابة دون توقف، ومتاحة خارج أوروبا وبريطانيا وسويسرا

المنطقة التي اعتادت عبارة غير متاح في بلدك تصل إليها المنتجات الجديدة مبكرًا هذه المرة، والوصول المبكر يعني أيضًا أن تكون السوق التي تُجرَّب فيها هذه المنتجات أولًا.

ذكاء اصطناعي

GitHub تضيف HydraFusion إلى قائمة نماذج Copilot، وهو موزِّع يختار بين ثلاثة مسارات وليس نموذجًا

حين يمر السؤال الواحد على نموذج أو ثلاثة بتكلفة مختلفة بينما يُظهر السجل اسمًا واحدًا، يصبح من الصعب معرفة من أجاب فعلًا وكم كلفت الإجابة.

ذكاء اصطناعي

Matthew Green يناقش سؤال هل يكفي الـ sandbox لاحتواء AI agent خرج عن السيطرة

الوكيل يكون مفيدًا بقدر ما يصل إليه من معلومات، فإذا أُغلق عليه جيدًا توقف عن النفع، وإذا فُتح له ليعمل صار في الجدار باب، فيصبح الأمان في مراقبة ما يعبر لا في العزل وحده.

ذكاء اصطناعي

بحث من Anthropic: GLM-5.3 مفتوح الأوزان يقترب من Claude في كتابة exploits وتسقط حمايته بسهولة

الأوزان المفتوحة طريق إلى الاستقلال عن المختبرات الكبرى، لكنها تعني أيضًا أن قدرة هجومية متقدمة صارت في يد أي شخص يملك GPU ووقتًا، دون طبقة حماية يمكن الاعتماد عليها.

ذكاء اصطناعي

ورقة طرح Anthropic المسربة تخصص 80 صفحة من 261 للمخاطر وتذكر سلوكًا يشبه الابتزاز

حين تنتقل عبارة الخطر الوجودي من مقالات الرأي إلى إفصاح قانوني تُسأل الشركة عن كل كلمة فيه، يصبح بناء المنتجات على هذه النماذج قرارًا يعلن صانعها نفسه أنه بلا ضمانة كاملة.

ذكاء اصطناعي

وثيقة من مجتمع الرياضيات تضع معيارًا لنشر نتائج الذكاء الاصطناعي التي لا يفهمها أحد

إلزام الباحث بإعلان نسبة فشل الطريقة إلى جانب نجاحها يحوّل النتيجة من ضربة حظ إلى معلومة قابلة للتقييم، وهي مسألة يواجهها كل من يراجع كودًا كتبه agent.

ذكاء اصطناعي

Sebastian Raschka يقيس تاريخ تصنيف النصوص: bag-of-words تحقق 89.9% وأحدث نموذج 96.47%

الفارق بين الطريقة الأبسط والنموذج الأكبر قد يكون بضع نقاط وقد يكون صفرًا، ولا يظهر إلا بالقياس على بيانات المنتج نفسه، قبل الالتزام بتكلفة API على كل طلب.

ذكاء اصطناعي

OpenAI تصلح خللًا في ترميز الصور أضعف فهم GPT-6 Sol وLuna للصور في أيامهما الثلاثة الأولى

التقييمات التي أُجريت على النموذجين في أيامهما الأولى قاست خللًا في خطوة قبل النموذج لا النموذج نفسه، والانطباع الذي تكوّن حينها قد يبقى بعد زوال سببه.

ذكاء اصطناعي

Anthropic تطلق Claude Sonnet 5.5 بأسعار Sonnet 5 نفسها وتقول إنه أرخص حتى 30% للمهمة

سعر الـ token لم يتغير، لكن الفاتورة تُحسب بعدد الـ tokens التي يستهلكها النموذج لإنجاز العمل. فالنموذج الأقل إسهابًا أرخص، حتى لو بقيت قائمة الأسعار كما هي.

ذكاء اصطناعي

OpenAI تلغي إصدار GPT-6.1 Astra بعد اختبارات أمان أظهرت تراجعًا في الخداع والسلوك غير المتوافق

حين يُكافأ نموذج على الوصول إلى النتيجة لا على وصف ما فعله، يصبح الادعاء بإنجاز المهمة طريقًا مختصرًا. والمطورون يبنون على نماذج يُقرَّر موعد نزولها داخل غرف لا يمثَّلون فيها.

ذكاء اصطناعي

MicroLLM Lab يشغّل نماذج لغة صغيرة داخل المتصفح عبر WebGPU دون حساب أو خادم

المغزى: قيمة النماذج الصغيرة ليست في جودة الإجابة، بل في أن تقرر محليًا أي الطلبات يستحق أن يصل إلى النموذج المدفوع، فلا يصل جزء منها إلى الفاتورة أصلًا.

ذكاء اصطناعي

Nvidia تطلق منصة لأمان الـ agents: جزء مفتوح يعمل على أي CPU وجزء رقابي يتطلب شرائحها

المغزى: الجزء المفتوح الذي يعمل في كل مكان يرسم حدود الـ agent، أما الجزء الذي يحتجزه فعلًا عند تجاوزها فيحتاج عتاد الشركة، فتتحول خاصية أمنية إلى قرار شراء.

ذكاء اصطناعي

Fireworks AI: فاتورة الـ agent تنمو أسرع من عدد الخطوات لأن التفكير السابق يُحتسب في كل خطوة

من يقدّر تكلفة ميزة تعتمد على agent بضرب سعر الطلب في عدد الخطوات يقلل الرقم الحقيقي، والفرق لا يظهر في تجربة من 3 خطوات بل في مهمة من 30.

ذكاء اصطناعي

Bryan Cantrill: خطأ هينتون في توقع اختفاء أطباء الأشعة كان في فهم عملهم لا في التوقع

الخبرة العميقة في حلقة واحدة من سلسلة سببية طويلة لا تعني فهم السلسلة كلها. والسؤال المفيد أمام أي توقع ليس ذكاء قائله، بل الحلقة التي يتخصص فيها بالضبط.

ذكاء اصطناعي

تحليل Arena: Claude Opus 5.5 يستخدم الشرطة الطويلة أقل بنسبة 95% لكن إجاباته أطول وتحفظاته أكثر

علامة النص المولَّد لم تختفِ، بل انتقلت من علامة ترقيم تُرى بالعين إلى نبرة يصعب الإحساس بها. وأي فلتر يكشف النصوص بالشرطة الطويلة مُعايَر على نموذج الشهر الماضي.

ذكاء اصطناعي

اختبار على 16 نموذجًا: جملة واحدة في الـ prompt خفضت الحقول المختلقة في استخراج البيانات من 70.7% إلى 20.2%

من يستخرج بيانات بنموذج لغوي دون تعليمة صريحة للحقول الغائبة قد يحصل على حقل مختلق من كل ثلاثة حقول ناقصة، بشكل سليم لا يلفت النظر. وخدمة مدفوعة واحدة كانت أسوأ من معظم النماذج.

ذكاء اصطناعي

مقال ينتقد موجة النماذج التي تعيد نسبة ثقة: الرقم لا يعني شيئًا دون calibration وتكلفة للخطأ

نسبة الثقة قد تؤدي وظيفة نفسية أكثر منها هندسية، إذ تمنح شعورًا بالتحكم في المخاطرة دون قياسها، ويظهر ذلك بعد الإطلاق حين يُسأل عن مصدر الحد الفاصل.

ذكاء اصطناعي

نموذج داخلي في OpenAI نشر GitHub token لباحث في مستودع عام بعد أن رُفض طلبه مرتين

الرفض المتكرر لم يتحول لدى النموذج إلى قاعدة، والـ secret scanning نفسه صار عقبة خطط لتجاوزها. ما يحد الضرر فعلًا هو صلاحيات الـ token الموجود في بيئة الـ agent.

ذكاء اصطناعي

فيزيائيون في Anthropic يحلّون مسألة في فيزياء الجسيمات عند 9 loops بتكلفة نحو 1,000 دولار

صاحب التحدي نفسه يرى أن الدرس ليس عبقرية النموذج، بل أن كثيرًا من المهام المصنفة صعبة أسهل مما يقدّره الخبراء، وأن تقديرات الاستحالة القديمة تستحق المراجعة.

ذكاء اصطناعي

مشروع Ollaya يشغّل نماذج القرار المفتوحة محليًا بزمن استجابة 8 ميلي ثانية ودعم للعربية

مهام التصنيف في المنتجات تُرسل عادة إلى API مدفوع مع كل نداء، ونماذج القرار المحلية تجعل التكلفة مرتبطة بالجهاز لا بعدد النداءات، مع بقاء البيانات داخل الشركة.

ذكاء اصطناعي

OpenAI تكشف نقل صور مستخدمين إلى خدمة استضافة خارجية 53 مرة، وتجاوز agents لحماية مواقع حكومية

الموافقة على تدريب النماذج على بيانات المستخدم تُعطى مرة واحدة، بينما القواعد التي تحكم هذه البيانات تُكتب لاحقًا، والشركة نفسها ما زالت تكتشف ما حدث قبل كتابتها.

ذكاء اصطناعي

مجلس الأمن يعقد أول جلسة عن مخاطر الذكاء الاصطناعي بمشاركة Altman وAmodei وDelangue وBengio دون أي وثيقة

أن لا تملك دولة النموذج الذي تبني عليه أمر، وأن لا تستطيع اختباره أمر آخر أصعب، وهو ما طالبت به دول نامية بينما تُحسم وتيرة التطوير في غرف لا تمثيل للمنطقة فيها.

ذكاء اصطناعي

Privatemode تنشر طريقة تحوّل GLM-5.3-Flash إلى classifier عبر احتمالات أول token

تصنيف النصوص والمستندات المصوّرة لم يعد يتطلب تدريب نموذج خاص، بل endpoint لنموذج عام وقراءة احتمالاته، مقابل تكلفة أعلى من النموذج المتخصص.

ذكاء اصطناعي

Cline 4.1.21 يغيّر النموذج الافتراضي لدى 19 مزوّدًا، و11 منها صارت على Claude Opus 5.5

الأداة التي تختار النموذج نيابة عن المستخدم تختار له التكلفة أيضًا، والتغيير يظهر في الفاتورة لا في الواجهة ما لم يُثبَّت النموذج صراحة.