SevenTnewS

Revue de presse · 29 juin 2026 – 5 juillet 2026 · SevenTnewS

SevenTnewS.com

Anthropic Restores Access to Claude Fable 5 After US Export Controls Lifted
Une

Anthropic Restores Access to Claude Fable 5 After US Export Controls Lifted

الأسبوع الذي واجهت فيه النماذج الحدودية منافسيها في التكلفة والوكلاء والواقع

الخيط الناظم لهذا الأسبوع: شهد مشهد الذكاء الاصطناعي هذا الأسبوع تصادماً بين الطموح والاحتكاك: تحدت إصدارات نماذج حدودية من ديب سيك وأنثروبيك وميني ماكس الافتراض القائل بأن الأداء المتميز يتطلب إنفاقاً احتكارياً، بينما أظهرت تهديدات الأمن السيبراني أن الخصوم يسخرون الذكاء الاصطناعي بنفس سرعة نشر المدافعين له. وفي الوقت نفسه، كشفت معايير جديدة من GauntletBench إلى FFASR عن فجوات صارخة بين الضجة المختبرية والموثوقية الواقعية. فشل الوكلاء في المهام البصرية، ودمرت التعديلات طويلة الأمد المستندات، وتبين أن سياقات المليون رمز الموعودة مضللة. ومع ذلك، وفي خضم عمليات التحقق الواقعية المقلقة، أشارت موجة موازية من الأدوات مفتوحة المصدر وتمويل البنية التحتية إلى أن النظام البيئي ينضج نحو نشر عملي وفعال، حتى لو لم يكن الوكلاء أنفسهم مستعدين لوقت الذروة.

Télécharger le PDF

1. إصدارات النماذج الحدودية تثير جدلاً حول الوصول والتكلفة

شهد هذا الأسبوع موجة من إصدارات النماذج التي تزيد الضغط على الشركات القائمة لتحقيق التوازن بين الأداء والانفتاح والقدرة على تحمل التكاليف. أصدرت ديب سيك معاينة لـ DeepSeek-V4 تدعي فيها قدرات استدلالية عالمية المستوى وقدرات وكيل محسنة مع بقائها مفتوحة الأوزان، كما أطلقت نموذجاً لغوياً جديداً يواصل توجهها نحو الكفاءة. أصدرت أنثروبيك Claude Sonnet 5 بأداء يقترب من مستوى Opus في المهام الوكيلية بسعر متوسط المستوى، وClaude Fable 5 للعمل المستقل طويل الأمد، بينما كشفت Aleph Alpha عن T-Free، وهي بنية خالية من المحللات الرمزية. أصدرت ميني ماكس M2.5، وهو نموذج برمجة تصدر Multi-SWE-Bench بجزء بسيط من التكلفة. تتحدى هذه الإصدارات الافتراض بأن النماذج الحدودية يجب أن تكون احتكارية أو باهظة الثمن.

[01] DeepSeek-V4 preview lands, and the open-...[02] MiniMax's new M2.5 coding model tops the...[03] Ma Jiaqi taught MiniMax engineers a hard...[04] Anthropic Launches Claude Fable 5: A Fif...[05] Anthropic Restores Access to Claude Fabl...[06] Anthropic Announces "The Briefing: AI fo...[07] Aleph Alpha unveils T-Free: a tokenizer-...[08] The case against enshittification: why s...[09] Claude Sonnet 5 is here, and Anthropic i...[10] Claude Sonnet 5 just made the Opus price...[11] Anthropic Boosts Claude API Rate Limits,...[12] DeepSeek's new model makes efficiency th...

2. تهديدات الأمن السيبراني تتصاعد مع الذكاء الاصطناعي والبرمجيات الخبيثة الجديدة

يكشف مشهد الأمن السيبراني هذا الأسبوع عن سباق تسلح متصاعد، يتسم بتهديدات آلية ومتطورة بشكل متزايد. تقدم التقارير أول هجوم فدية يُدار بالكامل بواسطة الذكاء الاصطناعي، ونشر برمجية Umbrij الخبيثة من قبل مجموعة ToddyCat APT لسرقة رموز OAuth، وثغرة يوم صفر خطيرة في أجهزة VPN المؤسسية. بالتزامن، وصلت هجمات الفدية إلى نطاق غير مسبوق، حيث بلغت المطالبات 120 مليون دولار وعملت الفرق كشركات متخصصة تستخدم تكتيكات الابتزاز الثلاثي. تهدف مبادرة أوروبية إلى تدريب 10,000 متخصص في الأمن السيبراني بحلول عام 2026 لمعالجة النقص الحاد في المواهب، بينما تم تسليم مراهق مرتبط بمجموعة الاختراق Scattered Spider إلى الولايات المتحدة.

[01] First fully AI-run ransomware attack dis...[02] ToddyCat apt deploys umbrij malware to h...[03] CISA adds microsoft sharepoint server vu...[04] Critical Zero-Day CVE-2025-XXXX Strikes...[05] WhatsApp username reservations raise imp...[06] The Rising Tide of AI-Powered Phishing:...[07] Teen accused in scattered spider hacking...[08] The ransomware renaissance: $120 million...[09] Europe's once-austerity founders are abo...

3. أدوات جديدة تُعزز ديمقراطية الذكاء الاصطناعي في العلوم وسير العمل العلمية

تهدف مجموعة من الأدوات الجديدة إلى تعزيز ديمقراطية الذكاء الاصطناعي في الأعمال العلمية والتقنية المتخصصة. قامت مايكروسوفت بنشر Data Formulator 0.7 مفتوح المصدر للتحليلات المؤسسية دون الحاجة إلى SQL، وأطلقت منصة Microsoft Discovery لبناء سير عمل وكيلية بالذكاء الاصطناعي في العلوم والهندسة، وفتحت أكاديمية أنثروبيك للتعلم حول Claude. قدمت أوبن إيه آي Prism، وهي مساحة عمل LaTeX مجانية مدعومة بـ GPT-5.2 للعلماء. أظهر Talos، وهو أداة مفتوحة المصدر، إعادة تحليل جينومية آلية قدمت 241 تشخيصاً جديداً لأمراض نادرة في 32 يوماً. حصلت DiagFit على 6.5 مليون يورو لمنهجها في التكنولوجيا الصحية الذي يجمع بيانات المرضى الحالية في درجة مخاطر موحدة. بالإضافة إلى ذلك، ماثل Phi-4 منافسين أكبر بكثير في معايير الاستدلال، مما يشير إلى تحول في التفكير حول توسيع نطاق النماذج.

[01] Microsoft open-sources Data Formulator 0...[02] Anthropic Academy: a free platform to le...[03] OpenAI launches Prism: a free LaTeX work...[04] Microsoft's Phi-4 Model Redefines Effici...[05] Talos shows automated genome reanalysis...[06] Microsoft Discovery Now Generally Availa...[07] DiagFit's €6.5 million bet on the data y...

4. نضوج أدوات الذكاء الاصطناعي مفتوحة المصدر والبنية التحتية يتسارع

يستمر النظام البيئي للذكاء الاصطناعي مفتوح المصدر في النضوج مع مساهمات كبيرة وتطورات في البنية التحتية. أعادت Hugging Face بناء خط أنابيب الإصدار الخاص بها لإصدارات عميل بايثون الأسبوعية وبسطت نشر خادم الاستدلال vLLM، كما قدمت Moon Bot، وهو وكيل برمجة داخل Slack. قدم Ollama 0.31 تسريعاً بنسبة 90% لـ Gemma 4 على شرائح أبل سيليكون عبر التنبؤ بعدة رموز. نشر BenchLM دليلاً إرشادياً لجعل الصفحات قابلة للاستشهاد بها من قبل مساعدي الذكاء الاصطناعي، وحققت طريقة تقطير مجموعة البيانات M3D دقة top-1 بنسبة 68.5% على ImageNet-1K مع صورة واحدة لكل فئة مع تقليل الذاكرة بعشرة أضعاف. تسلط هذه التطورات الضوء على التركيز المتزايد على النشر العملي والكفاءة وإمكانية إعادة الإنتاج.

[01] M3D and Real-Guidance Bring Dataset Dist...[02] How Hugging Face Ships Its Python Client...[03] Hugging Face Lets You Run a vLLM Server...[04] Hugging Face's Moon Bot turns Slack into...[05] How to Get Cited by ChatGPT, Perplexity,...[06] Token-Level Analysis Reveals Hybrid LLMs...[07] Gemma 4 runs 90% faster in Ollama 0.31 w...

5. تمويل Together AI والبنية التحتية يشير إلى ازدهار

يزدهر قطاع أعمال البنية التحتية للذكاء الاصطناعي، مع جولات تمويل كبرى وتحركات استراتيجية تعيد تشكيل المشهد التنافسي. جمعت شركة الحوسبة السحابية للذكاء الاصطناعي Together AI 800 مليون دولار بتقييم 8.3 مليار دولار، بينما حصلت شركة رقاقات الذكاء الاصطناعي Groq على 750 مليون دولار لتلبية الطلب المتزايد على الاستدلال، بالتعاون مع وزارة الطاقة الأمريكية وأعلنت عن توسعة بقيمة 1.5 مليار دولار في السعودية. كما جذبت لايم الانتباه مع طرحها العام الأولي البالغ 167 مليون دولار، رغم أنها تواجه أسئلة حول ديونها البالغة مليار دولار، ويُقال إن سبيس إكس عرضت نموذجاً أولياً لجهاز ذكاء اصطناعي على المستثمرين. تؤكد هذه التحركات التدفق الهائل لرأس المال إلى أجهزة الذكاء الاصطناعي والحوسبة السحابية والمشاريع ذات الصلة.

[01] Together AI raises $800 million at an $8...[02] Inside BenchLM's Data Pipeline: Why We D...[03] Apple reportedly planning new iPad pros...[04] Lime's IPO raised $167 million. That mig...[05] Spacex is developing an ai device protot...[06] Groq raises $750M as inference demand su...

6. معايير الذكاء الاصطناعي تكشف فجوات في الاستدلال والسياقات الواقعية

تكشف العديد من المعايير وأطر الاختبار الجديدة عن فجوات كبيرة بين أداء نماذج الذكاء الاصطناعي في الظروف الخاضعة للرقابة والظروف الواقعية أو خارج العينة. معيار ARC-AGI-2 يشهد تسجيل النماذج العليا 85% بينما متوسط البشر 66%، ومع ذلك يتصدر GPT-5.4 حزمة رياضيات مشبعة. يُظهر معيار AIMIP Phase 1 أن نماذج المناخ بالذكاء الاصطناعي تتفوق في الأنماط التاريخية لكنها تكافح مع السيناريوهات خارج العينة. يكشف لوحة متصدرين FFASR عن فجوة كبيرة بين دقة التعرف على الكلام في المجال القريب والمجال البعيد. والأبرز، وجد GauntletBench أن الوكلاء فشلوا في 81% من 100 مهمة كثيفة البصر عبر تطبيقات مهنية، بينما حقق البشر غير الخبراء نجاحاً يتجاوز 80%.

[01] ARC-AGI-2: The Benchmark That Measures F...[02] GPT-5.4 Leads the 2026 Math Benchmark Pa...[03] Aimip phase 1: A new benchmark to test a...[04] Treble Technologies and Hugging Face Lau...[05] Oxford's GauntletBench puts AI agents th...[06] ProgramBench: every public AI scores 0%...

7. وكلاء الذكاء الاصطناعي يواجهون عقبات حرجة في الموثوقية والتحقق

يكشف بحث جديد عن فجوات أساسية في موثوقية وكلاء الذكاء الاصطناعي، خاصة في المهام طويلة الأمد والتحقق. تظهر الدراسات أن نماذج اللغات الكبيرة تُدخل أخطاء دلالية في المستندات بعد التعديلات المفوضة المتكررة، بمعدلات تدهور تتراوح بين 19% و34% خلال 20 تكراراً في معيار DELEGATE-52، وأصبح التحقق من مخرجات وكيل البرمجة أصعب من توليد الكود. وجد اختبار ProgramBench أن كل نموذج عام سجل 0% في إعادة بناء البرامج من الملفات الثنائية. يكشف معيار MosaicLeaks أن وكلاء البحث العميق يُسربون معلومات داخلية حساسة عبر استعلامات ويب صادرة، مع طريقة تدريب تقلل التسريب بمقدار ثلاث مرات. تؤكد هذه النتائج أن موثوقية الوكيل لا تزال عائقاً حاسماً أمام النشر.

[01] Llms corrupt your documents when you del...[02] AI document corruption in delegated work...[03] The verification horizon: why verifying...[04] Your AI research agent is leaking privat...[05] Vega brings zero-knowledge proofs to ide...[06] Cloudflare to block mixed-use web crawle...

8. البنية التحتية للذكاء الاصطناعي وأدوات التحسين تكتسب زخماً

تؤكد عدة إصدارات هذا الأسبوع على مشهد بنية تحتية للذكاء الاصطناعي ينضج ويركز على الكفاءة والنشر الواقعي. كشفت مايكروسوفت النقاب عن GridSFM وData Formulator 0.7، مستهدفة تحسين شبكات الطاقة وسير عمل البيانات المؤسسية على التوالي، بينما سلطت الضوء أيضاً على أداء موزع الذاكرة mimalloc في خدمات الذكاء الاصطناعي. تقدم مكتبة Sipp من Noumena Labs تسريعاً بمقدار 3 إلى 5 مرات للاستدلال المحلي للذكاء الاصطناعي، وتقوم Talos بأتمتة إعادة التحليل الجينومي لتسريع تشخيص الأمراض النادرة. معاً، تُظهر هذه الأدوات تحولاً من الأداء الخام للنموذج إلى تشغيل الذكاء الاصطناعي بأقل قدر من النفقات العامة.

[01] Microsoft releases gridsfm, a lightweigh...[02] Microsoft’s GridSFM predicts power grid...[03] Microsoft just opened a codebase that ki...[04] mimalloc, Microsoft's tiny memory workho...[05] Sipp.sh Launches Open-Source Library for...[06] Talos, an open-source tool, automates re...

9. نمذجة الاستدلال وتحسين النماذج الكبيرة

تتيح التطورات في تحسين الاستدلال نشراً أكثر كفاءة وفعالية من حيث التكلفة للنماذج الكبيرة. نشرت Aleph Alpha نماذج استدلال نظرية لـ DeepSeek V3 بناءً على أساسيات الأجهزة، مما يوفر للممارسين إطاراً لدراسة المفاضلات بين زمن الاستجابة والإنتاجية والتكلفة. أصدرت Ai2 OlmoEarth v1.1، لتقليل تكاليف حوسبة الذكاء الاصطناعي لصور الأقمار الصناعية بمقدار ثلاث مرات من خلال دمج الرموز المميزة المتعددة الدقة. تقدم مكتبة Sipp من Noumena Labs تسريعاً بمقدار 3 إلى 5 مرات للاستدلال المحلي للذكاء الاصطناعي. كشف تحليل مفصل للنماذج اللغوية الكبيرة الحدودية أن نوافذ السياق الموعودة التي تزيد عن مليون رمز مضللة، حيث يختلف الاستدعاء الفعلي والتكاليف بشكل كبير، مما يكشف فجوة بين التسويق والقدرة الفعلية.

[01] Aleph Alpha builds theoretical inference...[02] Aleph Alpha builds a theoretical inferen...[03] Ai2 cuts satellite imagery AI costs by 3...[04] Your AI model says it can read 1 million...

10. الخصوصية والأمان والتحكم في المحتوى في الذكاء الاصطناعي تشتد

تثير مخاوف الخصوصية والأمان المحيطة بالذكاء الاصطناعي استجابات تقنية وسياسية جديدة. قدمت Vega نظام إثبات المعرفة الصفرية للتحقق من الهوية يُنشئ البراهين في أقل من 100 ميلي ثانية دون تحميل المستندات. أعلنت Cloudflare أنها ستحظر زاحفي الويب متعددي الاستخدامات بشكل افتراضي اعتباراً من سبتمبر 2026، مما يمنح مالكي المواقع سيطرة أكبر على المحتوى المستخدم لتدريب الذكاء الاصطناعي وخدمات الوكيل. وفي الوقت نفسه، يعيد الصعود التجاري لـ RISC-V تشكيل تصميم المعالجات، متحدياً البنى الاحتكارية مثل ARM وx86، مما قد يؤثر على أمان الأجهزة والتحكم.

[01] Your AI research agent is leaking privat...[02] Vega brings zero-knowledge proofs to ide...[03] Cloudflare to block mixed-use web crawle...[04] How Open-Source RISC-V Is Disrupting the...

11. طرق جديدة لفهم النماذج والتحقق منها

تعالج التطورات في قابلية التفسير والتحقق الحاجة المتزايدة للجدارة بالثقة في تطبيقات الذكاء الاصطناعي عالية المخاطر. طور باحثون من مايكروسوفت وشركاء آخرين الاختبار السببي التوليدي، وهو إطار يُقطر نماذج التنبؤ بالدماغ ذات الصندوق الأسود إلى تفسيرات لفظية قابلة للاختبار، مكتشفين مناطق عصبية دقيقة جديدة. قدمت دراسة أخرى MaxProof، الذي يحول المدققات التوليدية إلى أداء موثوق pass@1، مما يمكّن نموذجاً من تجاوز عتبات الميدالية الذهبية البشرية في مسائل الأولمبياد الدولي للرياضيات والأولمبياد الأمريكي للرياضيات. تكمل هذه الأساليب النقاش الأوسع حول الذكاء الاصطناعي كامتداد معرفي، بحجة ورقة بحثية متعددة التخصصات جديدة أن أنظمة الذكاء الاصطناعي الحديثة تستمد قوتها من هياكل متجذرة في الإدراك البشري بدلاً من محاكاة الذكاء.

[01] Microsoft's new method turns black-box b...[02] How maxproof turns generative verifiers...[03] AI as an extension of human intelligence...

12. طفرة في أبحاث الرؤية واللغة والمتعددة الوسائط

تهيمن موجة من الأبحاث في الرؤية واللغة من مؤسسات مثل ستانفورد ومعهد ماساتشوستس للتكنولوجيا على الصفحة الشائعة في Hugging Face، مما يشير إلى أن المجتمع يضاعف جهوده على البنى متعددة الوسائط التي تدمج الفهم البصري مع اللغة. يتماشى هذا الاتجاه مع الجهود الأوسع لدفع الذكاء الاصطناعي إلى ما وراء القدرات النصية فقط، كما يتجلى في إصدار GPT-Live، وهو نموذج صوتي ثنائي الاتجاه كامل يتحرر من المحادثة الصارمة القائمة على تبادل الأدوار، مما يجعل التفاعلات أكثر طبيعية. يمثل التحول المعماري نحو الحوار الفوري القابل للمقاطعة خطوة كبيرة إلى الأمام في الذكاء الاصطناعي التحادثي.

[01] Why vision-language papers are flooding...[02] OpenAI's GPT-Live finally stops waiting...

Conclusion

يشير القوس السردي للأسبوع إلى أن صناعة الذكاء الاصطناعي تدخل مرحلة معايرة قاسية: يجب على صانعي النماذج الآن التنافس على التكلفة والانفتاح بقدر ما يتنافسون على القدرات الخام، بينما يطالب المستخدمون بإثبات، وليس وعود، للفائدة الواقعية. الفجوة بين العرض التجريبي والنشر تضيق، لكن المعايير الجديدة وإخفاقات الوكلاء تجعل من الواضح أن الهندسة والجدارة بالثقة، وليس فقط عدد المعاملات، هي التي ستفصل الفائزين عن المتخلفين في الأشهر المقبلة.

Généré à partir de la revue SevenTnewS du 19/07/2026 69 articles regroupés en 12 thèmes dédupliqués.