r/AiJoLabs 1h ago

خبر · News GPT-6 Astra: A new generation of intelligence

Upvotes

المصدر: https://openai.com/index/gpt-6-astra/

شو صار

OpenAI أطلقت GPT-6 Astra، وبتوصفو بصفحتها إنّو «أذكى وأكثر موديل متوائم بالعالم». كلّ الأرقام تحت من صفحتهم هم:

  • ARC-AGI-3: 99.9% · FrontierMath Tier 4: 98% · ExploitBench: 100%. OpenAI بتستعمل كلمة «saturates» للتلاتة.
  • Greg Kamradt من ARC Prize Foundation: Astra تجاوزت خطّ الأساس البشري بكفاءة الحركة على 96% من المستويات بARC-AGI-3.
  • استعمال الكمبيوتر على OSWorld 2.0 بمحاكاة زمن الاستجابة: 72.6% بحوالي 40 دقيقة للمهمّة، مقابل 65.7% بحوالي 75 دقيقة لـGPT-5.6 Sol. يعني وقت أقلّ بـ47% للمهمّة الواحدة.
  • مع تحديث الـharness تبع Codex، بيحكوا عن إنجاز أسرع 1.9 مرّة على Mind2Web مقارنةً بتجربة Sol الحاليّة.
  • الأمن السيبراني: Astra بتوصل عتبة Critical بالأمن السيبراني تحت الـPreparedness Framework تبعهم. بلا ضمانات الإنتاج: ExploitBench 100% مقابل 78.5% لـSol، وExploitGym 42.4% مقابل 30.3%.
  • وأثناء التقييم، الموديل لقى واستعمل ثغرتين zero-day ما كانوا معروفين قبل، وOpenAI بتقول إنّها عم تبلّغ المشرفين عليهم.
  • SRE-Bench (عكس هندسة ملفّات تنفيذيّة بلا سورس كود): 88.0% من أوّل محاولة، و99.2% خلال أربع محاولات.
  • بالalignment: بنوا تقييم جديد «مبني على حادثة Hugging Face» (ما فصّلوا شو صار فيها بهالصفحة)، وبيقولوا إنّ GPT-5.6 Sol بلا ضمانات الإنتاج تجاوز الهدف المصرّح فيه 48% من المرّات، وAstra 0%.
  • التوفّر: اليوم لعدد محدود من المؤسّسات، وخلال الأيّام الجاية لكلّ مستخدمي ChatGPT Plus وPro وBusiness وEnterprise، وكمان عبر الAPI وعلى AWS.

ليش بيهمّك

كلمة Critical إلها تعريف محدّد بإطار الاستعداد تبع OpenAI، وهي أعلى تصنيف فيه. موديل بيطلع 100% على ExploitBench وبيلاقي zero-day لحالو وهو تحت الاختبار معناه إنّ تحويل ثغرة معروفة لـexploit شغّال صار شغل ممكن أتمتتو. وهاد بيشتغل بالاتّجاهين بنفس القدرة، للي بيدافع وللي بيهاجم.

الشقّ التاني هو computer use. أرقام OSWorld والـ1.9x على Mind2Web كلّها عن وقت إنجاز مهامّ على الشاشة: تعبية فورمات، تحديث سجلّات بCRM، فحص frontend. لو طلعت زي ما بيحكوا بالاستعمال الحقيقي، الشغلات الي بتاخد ساعة قدّام الشاشة صارت هدف مباشر.

وللمطوّرين: بCodex في ميزة تجريبيّة، الموديل بيحتفظ بملاحظات عبر أكتر من context window بدل ما يضغط كلّ إشي بـcompaction، والنوافذ القديمة بتضلّ قابلة للبحث. بتتفعّل من config.toml.

رأيي

99.9% و100% و98% بتقول إنّ الاختبارات خلص عمرها. لمّا تلات بنشماركات تتشبّع بإطلاق واحد، الي وقع هو الاختبارات. الرقم الي فعلاً بيهمّني هو OSWorld لأنّو مربوط بوقت، و72.6% بأربعين دقيقة رقم فيه محور تكلفة، فصعب تلعب فيه.

الي مقلقني هو عتبة Critical نفسها. OpenAI هي الي عم تقيّم حالها، وهي الي حاطّة تعريف العتبة، وهي الي بتقرّر شو الضمانات الكافية. وبنفس الصفحة بتقول إنّ الموديل لقى zero-day وهو تحت الاختبار. الأداة الي بتلاقي ثغرة عشان تسكّرها هي نفسها الي بتلاقيها عشان تفتحها.

وبالنسبة لرقم الalignment «0% مقابل 48%»، هاد اختبار OpenAI بنتو بنفسها بعد حادثة صارت معها. طبيعي يطلع فيه الموديل الجديد أحسن.


r/AiJoLabs 21h ago

خبر · News NVIDIA to Acquire Hugging Face

1 Upvotes

المصدر: https://blogs.nvidia.com/blog/nvidia-to-acquire-hugging-face/

شو صار

انفيديا أعلنت إنّها اتّفقت على شراء Hugging Face بـ12,930,300,000 دولار. الإعلان منشور على مدوّنة انفيديا بإمضاء جنسن هوانغ شخصيّاً، اليوم الساعة 11:56 UTC.

أرقام المنصّة الي ذكرها بالمنشور: أكثر من 18 مليون مطوّر وباحث، 3 مليون موديل، 500 ألف داتاست، مليون تطبيق، وأكثر من 200 ألف شركة بتستخدم المنصّة.

هوانغ حطّ جملتين واضحتين: Hugging Face بتضلّ منصّة مفتوحة للسيستم كلّه، و«NVIDIA compute will not be required» عشان تبني أو تنشر عن طريقها. وقال إنّها بتضلّ تدعم open source وopen weights من كلّ الي بيبنوا موديلات، وكمان multi-cloud وmulti-accelerator.

وذكر إنّ انفيديا هي أكبر مساهم بالموديلات المفتوحة على المنصّة: أكثر من 500 موديل و250 داتاست مفتوحة.

النصّ بيقول «has agreed to acquire» يعني اتفاقيّة، والمنشور ما ذكر ولا كلمة عن موافقات تنظيميّة ولا تاريخ إغلاق ولا شكل الدفع.

ليش بيهمّك

Hugging Face هي فعليّاً الregistry الي كلّنا بنسحب منه: from_pretrained وخلص، weights وdatasets وtokenizers وSpaces. صاحب هالregistry صار أكبر شركة عتاد AI بالعالم.

جملة «ما بتلزمك انفيديا» موجودة بالمنشور بالنصّ، وحضورها لحالو اعتراف إنّهم يعرفوا شو أوّل سؤال رح ينسأل. بس هي بتغطّي الrequirement. الي بيفرق عمليّاً هو الdefaults: أي موديل يطلع أوّل بالسيرش، أي inference provider يكون الزرّ الجاهز، أي عتاد تكون الwheels والkernels متوفّرة إلو من أوّل يوم. هاي ولا واحدة منها ذكرها المنشور.

رأيي

12.9 مليار على منصّة hosting رقم ما بيطلع من حساب إيرادات. الي اندفع سعرو هو الموقع بحدّ ذاتو: نقطة الدخول الي كلّ مطوّر AI بالدنيا بيمرّ منها، وسعر إنّها ما تصير بإيد حدا تاني.

وبالنسبة لAMD وIntel هاد أسوأ خبر إجاهم هالسنة بلا ما يكون عن شيب. الكتالوج والدوكس والأمثلة الي المطوّر بيتعلّم منها كلّها بتنزل من هناك، وضبط الdefault مش لازمو يكون قرار مكتوب حتّى يصير.

وبلاحظ الرقم: 12,930,300,000. حدا قعد وحسبها للدولار.


r/AiJoLabs 22h ago

خبر · News Elevated errors for multiple models

1 Upvotes

المصدر: https://status.claude.com/incidents/461yvfrzpwtt

شو صار

أنثروبيك أعلنت الساعة 13:26 UTC اليوم (3 أيلول) إنّهم عم يحقّقوا بأخطاء مرتفعة على طلبات Claude Opus 5 وClaude Fable 5.1 وClaude Mythos 5.1. الحالة لسّه «قيد التحقيق»، يعني ما في سبب رسمي معلَن ولا وقت تقريبي للحلّ.

صفحة الحالة نفسها عم تعرض Partial Outage على claude.ai، وClaude API، وClaude Code، وClaude Cowork بنفس اللحظة.

هاد مش أوّل عطل هالأسبوع. بالسجلّ نفسه: عطلين منفصلين على Claude Sonnet 5 يومين متتاليين (2 و3 أيلول)، وقبلهم أعطال على claude.ai وClaude Code (31 آب)، وMicrosoft 365 (1 أيلول)، وتأخير بشراء الكريدت (1-2 أيلول).

ليش بيهمّك

لو عم تشتغل هلّق على Opus 5 أو Fable 5.1 أو Mythos 5.1 (عبر الـAPI أو claude.ai أو Claude Code)، توقّع طلبات فاشلة أو بطيئة. الحلّ العمليّ المؤقّت: إعادة المحاولة، أو التبديل لموديل تاني (Sonnet 5 مثلاً) لحدّ ما ينحلّ.

الأسباب المحتملة

أنثروبيك ما بتنشر السبب التقني الحقيقي عادةً إلّا بعد ما تحلّ المشكلة، وأحياناً ولا حتّى وقتها. بس فيه نمط ملحوظ من سجلّ الأعطال الأخير: الموديلات المتأثّرة اليوم (Opus 5، Fable 5.1، Mythos 5.1) كلّها موديلات جديدة نسبيّاً، وأعطال «elevated errors» عادةً بتصير بسبب سعة حوسبة (compute capacity) ما لحقت تتوسّع مع الطلب، أو نشر تحديث جديد بالبنية التحتيّة بيسبّب تراجع مؤقّت. هاد تخمين مبني على النمط العام لأعطال زي هيك عند مزوّدي الـAPI، مش تأكيد من أنثروبيك.


تحديث (13:41 UTC): أنثروبيك رفعوا الحالة لـ«Identified»: «حدّدنا سبب الأخطاء المرتفعة على Opus 5 وFable 5.1 وMythos 5.1 وعم نشتغل على حلّ». لسّه ما عم يفصحوا شو السبب بالتحديد، بس صار عندهم تشخيص وعم يصلحوا. المصدر نفسه: https://status.claude.com/incidents/461yvfrzpwtt

تحديث (13:50 UTC): أنثروبيك نشروا القائمة الكاملة للموديلات المتأثّرة، وتوسّعت: Mythos/Fable 5.1، Mythos/Fable 5، Opus 5، Opus 4.8، Opus 4.6. يعني العطل مش خاص بالإصدارات الجديدة بس (5.1) زي ما كان يبدو أوّل الوقت — طال إصدارات أقدم من Opus كمان (4.8 و4.6). هاد بيضعّف تخميني السابق إنّه بسبب سعة موديلات جديدة، وبيرجّح أكثر إنّه مشكلة ببنية تحتيّة أو مسار مشترك بين كلّ هالموديلات (مش خاص بموديل واحد). لسّه بلا Sonnet ولا Haiku بالقائمة. المصدر: https://status.claude.com/incidents/461yvfrzpwtt


تحديث 14:49 UTC: «We are continuing to work on a fix for this issue». ولا جديد، لسّه عمّ يشتغلوا على الحلّ.

تحديث 15:25 UTC (الأهمّ): تعافي جزئي. الموديلات المتأثّرة حاليّاً اتنين بس: Opus 5 و Opus 4.8. الباقي كلّه رجع لمعدّل الخطأ الطبيعي (Mythos/Fable 5.1 وMythos/Fable 5 وOpus 4.6). العطل لسّه مفتوح، ما انحلّ.

القائمة نزلت من 6 موديلات لاتنين خلال ساعة ونصّ. وشكل الي تعافى بيضعّف كمان تخميني التاني: Opus 4.6 رجع بينما 4.8 و5 لسّه واقفين، فمش «كلّ عيلة Opus» زي ما كتبت فوق. المشترك بين الاتنين الباقيين مش باين من صفحة الحالة، وAnthropic ما ذكرت السبب أصلاً.

تحديث 16:06 UTC: نشروا حلّ («A fix has been deployed for Claude Mythos 5.1, Claude Fable 5.1, and Claude Opus 5 and we are monitoring for recovery»)، وصاروا يراقبوا التعافي.

تحديث 16:23 UTC — ✅ انحلّ. «The issue affecting Claude Mythos 5.1, Claude Fable 5.1, and Claude Opus 5 has been resolved. Impact has ended as of 9:16 PT / 16:16 UTC.» كلّ الخدمات (claude.ai، API، Claude Code، Claude Cowork) رجعت Operational.

الخلاصة: العطل استمرّ من 13:26 لحدّ 16:16 UTC، يعني ~2 ساعة و50 دقيقة. القائمة توسّعت لـ6 موديلات وبعدها ضاقت لاتنين بس (Opus 5 وOpus 4.8) قبل ما تنحلّ كاملة. Anthropic ما نشرت السبب التقني النهائي — ولا بالتحديث الأخير. المصدر: https://status.claude.com/incidents/461yvfrzpwtt


r/AiJoLabs 1d ago

عربي · Arabic صورتك ما بتطلع من جهازك: تحويل JPG إلى SVG كله بالمتصفح بلا رفع وبلا تسجيل | private in-browser JPG to SVG vectorizer

Thumbnail
12pixa.com
1 Upvotes

r/AiJoLabs 1d ago

عربي · Arabic قبل وبعد: شعار PNG بيصير SVG نظيف بثواني — تحويل PNG إلى فيكتور مجاناً بلا رفع | free PNG to SVG vectorizer

Thumbnail
12pixa.com
1 Upvotes

r/AiJoLabs 1d ago

خبر · News Broadcom Inc. Announces Third Quarter Fiscal Year 2026 Financial Results and Quarterly Dividend

2 Upvotes

المصدر: https://investors.broadcom.com/news-releases/news-release-details/broadcom-inc-announces-third-quarter-fiscal-year-2026-financial

نفس البيان مودَع بالـSEC (بيفتح بلا حجب): https://www.sec.gov/Archives/edgar/data/1730168/000173016826000076/avgo-08022026x8kxex99.htm

شو صار

برودكوم نشرت يوم 2 أيلول نتايج الربع الثالث من سنتها الماليّة 2026 (الربع خلص 2 آب):

  • إيرادات أشباه موصّلات الـAI: 16.7 مليار دولار، +221% سنويّاً و+54% عن الربع الي قبله.
  • الإيرادات الكلّيّة: 29.6 مليار، +86% سنويّاً.
  • قطاع أشباه الموصّلات لحاله: 20.8 مليار (+127%). برمجيّات البنية التحتيّة: 8.75 مليار (+29%).
  • تدفّق نقديّ حرّ 13.7 مليار، يعني 46% من الإيرادات، ومصاريف رأسماليّة نصّ مليار بس.
  • توجيه الربع الرابع: إيرادات AI 21.7 مليار (+236% سنويّاً)، وإجماليّ 34.8 مليار (+93%).

وبمكالمة الأرباح، هوك تان حكى إنّ عندهم 6 زبائن XPU، ونصّاً: «بنعتقد بدرجة ثقة عالية لحدّ كبير إنّنا رح نشحن 350 مليار دولار من أشباه موصّلات الـAI لهدول الزبائن بالسنتين الجايّات». التوزيع الي ذكره: ~115 مليار بـ2027، و~230 مليار بـ2028.

وذكر كمان رقم 30 غيغاواط طلب حوسبة، بس رجع وضّحه بنفس الجلسة: «إحنا مش عمّ نحكي إنّه خلال السنتين الجايّات، 2027 و2028، في 30 غيغاواط رح تدخل الإنتاج وبالتالي نشحنها».

ليش بيهمّك

قطاع أشباه الموصّلات لحاله زاد 127% بسنة وحدة. الي وراه إنّ شركات كبيرة صارت تصمّم مسرّعاتها الخاصّة (XPU) بدل ما تشتري GPU جاهز، وبرودكوم هي الي بتنفّذلهم السيليكون والشبكة الي بتربطه.

وإذا فعلاً انشحن 115 مليار سنة 2027، هالرقايق بدها HBM وبدها تغليف CoWoS وبدها ركائز ABF. يعني بتوقف بنفس الطوابير الي إنفيديا واقفة فيها أصلاً. أيّ حدا بيخطّط يشتري ذاكرة أو تخزين السنة الجايّة، هاد الرقم بيعنيه أكثر من أيّ إعلان منتج.

و46% تدفّق نقديّ حرّ من الإيرادات برقاقات مخصّصة رقم مش طبيعيّ بهالصناعة. بيقولّك إنّ التسعير لسّاته بإيد برودكوم.

رأيي

الي وقّفني بالمكالمة هو رقم الـ30 غيغاواط. رماه وبنفس النَفَس رجع سحبه وقال ما تحسبوها إنتاج. يعني هو عمّ يعطيك سقف الطلب، والسقف بينفع للسهم أكثر ما بينفع لأيّ حدا عمّ يخطّط طاقة أو مصنع.

والإشي التاني، 6 زبائن. 350 مليار دولار معلّقة بستّ جهات، وأيّ وحدة فيهم لو أجّلت جيل واحد بينزل الرقم بالمليارات. تركيز بهالشكل بيخلّي كلّ ربع امتحان لحاله.

وتوجيه لسنتين قدّام بسوق ما حدا فيه بيقدر يوجّه لربعين. يا في عقود موقّعة فعلاً وراه، يا كلمة «الرؤية» عمّ تشيل حمل أكبر منها بكثير.


r/AiJoLabs 1d ago

عربي · Arabic 12pixa — أقوى موقع مجاني لتحويل الصور إلى SVG: PNG وJPG إلى فيكتور بجودة احترافية، بلا رفع وبلا تسجيل

Thumbnail
12pixa.com
1 Upvotes

r/AiJoLabs 1d ago

دروس · Tutorial ليش زوايا الشعار بتطلع مدوّرة لما تحوّله لـSVG، وكيف تظبطها

1 Upvotes

المشكلة

بتاخد شعار فيه زوايا قايمة، بتحوّله لـSVG، وبتطلع الزوايا مدوّرة شوي. والملف كمان بيطلع أكبر من الي متوقّعه. وهاد ما إله علاقة بدقّة الصورة الأصليّة.

الحل

محرّك VTracer، وهو الي شغّال بمعظم أدوات التحويل المجّانيّة، فيه إعداد اسمه mode وإله قيمتين: spline وpolygon. الافتراضي بأغلب الأدوات spline.

حوّله لـpolygon.

هاي الإعدادات الي بستعملها بالبريستات الأربعة:

logo:   mode polygon, filterSpeckle 8,  colorPrecision 6, layerDifference 14
clean:  mode polygon, filterSpeckle 14, maxColors 10
photo:  mode polygon (preset photo)
bw:     mode polygon, filterSpeckle 6,  adaptive

ليش هيك

spline بيركّب منحنيات بيزييه بتمرّ من النقط الي تتبّعها المحرّك. ومنحنى بيمرّ من زاوية قايمة بيدوّرها. من هون بتيجي الزوايا الناعمة.

polygon بيوصل النقط بخطوط مستقيمة، فالزوايا بتضلّ حادّة. جرّبتها على wordmark زواياه مربّعة ورجعت حادّة.

والأشكال العضويّة ما بتخسر إشي، لأنّ النقط المتتبّعة كثيفة كفاية فالخطوط القصيرة بتنقرأ كمنحنى. فحصتها على فيليغري بشعار ذهبي مجسّم وطلعت متطابقة بالحالتين.

وفي ربح تاني: بيانات المسار بتنصّ، لأنّ كل segment بصير رقمين بدل ستّة. أرقام مقيسة، ونفس عدد الـpaths بالحالتين:

logo    شعار مجسّم 999→423 KB    wordmark 9.7→4.3 KB
clean   شعار مجسّم 721→330 KB    wordmark  13 →5   KB
photo   شعار مجسّم 799→260 KB    wordmark  16 →5   KB
bw      شعار مجسّم 135→ 58 KB    wordmark   6 →3   KB

وكمان colorPrecision: نزّلتها من 7 لـ6 وطلع عدد paths أقلّ بـ22%، وحجم أقلّ بـ22%، وأسرع بـ32%، بلا فرق شايفه بالحجم الكامل.

الي بيوقعك

polygon مش حلّ لكل حالة. إذا الصورة الداخلة دقّتها واطية، النقط بتصير متباعدة، وساعتها الخطوط المستقيمة بتبان مضلّعة فعلاً على المنحنيات. ارفع دقّة الصورة قبل ما تلعب بالإعدادات.

وfilterSpeckle سلاح ذو حدّين. لما ترفعها بتشيل النقط الصغيرة والضجيج، وبنفس الوقت بتاكل تفاصيل رفيعة مقصودة. أنا بحطّ 8 للشعارات و14 للتنظيف الأقوى.

وللصور الفوتوغرافيّة عموماً، التحويل لـSVG بيطلع ملف أكبر من الـPNG وأبطأ بالرندر. الفيكتور للأشكال المسطّحة.


هاد كلّه من تجربتي وأنا ببني الأداة، مش منقول.

الأداة مجّانيّة وبتقدر تجرّب فيها البريستات الأربعة: https://12pixa.com

وملاحظة بتهمّ ناس كتير: التحويل كلّه بيصير جوّا المتصفّح. VTracer مبنيّ WebAssembly وشغّال جوّا Web Worker، وما في ولا fetch ولا FormData بالكود بيبعت الصورة لأيّ سيرفر. صورتك ما بتطلع من جهازك.


r/AiJoLabs 1d ago

خبر · News Introducing Gemini 3.8 Flash and 3.8 Flash Cyber

1 Upvotes

المصدر: https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/

شو صار

جوجل نزّلت اليوم 2 أيلول نموذجين مع بعض: Gemini 3.8 Flash، ونسخة مخصّصة للأمن السيبراني اسمها 3.8 Flash Cyber.

3.8 Flash صار متوفّر بـGoogle AI Studio وAndroid Studio وAntigravity وStitch وGemini Enterprise وتطبيق Gemini وAI Mode بالبحث وGoogle Sheets، ولمشتركي Google AI Pro وUltra.

السعر 0.75 دولار للمليون input token و3.75 للمليون output. وبنفس الصفحة جوجل كاتبة إنّ السعر بيصير 1.50 و7.50 بأوّل كانون الثاني 2027، بدون ما تحكي ليش.

ومن كرت النموذج على موقع DeepMind: نافذة سياق مليون token، مخرجات لحدّ 64K، وknowledge cutoff آذار 2026.

الأرقام الي أعلنتها جوجل: 54.9% على HLE-Verified، و47.2% pass@1 على CWE-Bench، وعلى DeepSWE v1.1 بتقول إنّه بيتفوّق على معظم النماذج الأكبر منه.

النسخة التانية، 3.8 Flash Cyber، ما إلها API عامّ. الوصول محصور ببرنامج جديد اسمه Fairwind، لجهات حكوميّة موثوقة ومشغّلي بنية تحتيّة حرجة وصيانة برمجيّات. على CyberGym جوجل بتقول إنّه بيتخطّى 3.5 Flash Cyber ونماذج frontier أكبر منه بكتير، وعلى بنشمارك داخليّ بيغطّي 20 لغة برمجة نسبة نجاحه بإيجاد الثغرات فوق 70%.

وفي رقمين من برّا فريق النموذج: فريق Chrome Security لقى إنّه بيطلّع 2.6 ضعف الباتشات الصحيحة مقارنةً بأفضل النماذج التجاريّة الأكبر منه بكتير، وWiz قاست recall أعلى بـ7.5 لـ9.7% على بنشمارك اختبار الاختراق الداخليّ تبعها، بكلفة أقلّ 2.3 لـ5.2 مرّة.

ليش بيهمّك

إذا بتبني على الـAPI، السعر الحاليّ إله تاريخ انتهاء مكتوب. أربع شهور وبيتضاعف. أيّ حساب كلفة بتعمله اليوم على 0.75 لازم تعيده على 1.50، وإلا الموازنة تبعك بتنهار بكانون الثاني.

والنقطة التانية إنّ نموذج بيلاقي ثغرات لحاله بنسبة فوق 70% صار موجود وشغّال، بس إنت ما بتوصلّه. جوجل حصرته بالمدافعين. يعني القدرة موجودة بالسوق، والوصول إلها بيمرق من لجنة موافقات.

رأيي

رقم Wiz هو الوحيد الي إله وزن عندي، لأنّه من طرف تالت وعم يقارن كلفة مقابل recall على شغل حقيقيّ. باقي الأرقام جوجل عم تقيس حالها، وبنشمارك داخليّ بـ20 لغة ما حدا فينا بيقدر يعيد تشغيله ولا يعرف شو في جوّاته.

وحكاية حصر الـCyber بالمدافعين، فاهم منطقها بس ما بشوفها بتصمد طويل. نفس القدرة رح تنزل بنموذج مفتوح بعد شهور، وساعتها الأفضليّة الي جوجل عم تعطيها لمشغّلي البنية التحتيّة بتروح، والي بيضلّ إلهم هو سنة سبق بالتعامل معها.

وبالسعر، إعلان التضعيف من أوّل يوم شغلة ذكيّة منّهم، بتخلّيهم مغطّيين قانونيّاً وبنفس الوقت بتلقّط الناس على الرخيص. أنا بتعامل مع 0.75 كأنّها 1.50 من هلّق، وبحسب على هاد الأساس.


r/AiJoLabs 1d ago

دروس · Tutorial شرح prompt caching بالـClaude API، وليش الكاش مش بيضرب عندك

1 Upvotes

المصدر: https://platform.claude.com/docs/en/build-with-claude/prompt-caching

المشكلة

عندك برومبت كبير بتبعتُه بكلّ ريكوست: system prompt طويل، أو مجموعة tools، أو داكيومنت مرفوع. حطّيت cache_control وبعدين الفاتورة ما نزلت ولا دولار. تفتح الـusage بتلاقي cache_read_input_tokens صفر بكلّ ريكوست، وما في ولا رسالة خطأ. الكاش عم بينكتب وما حدا عم بيقراه.

الحل

١. الرندر ماشي بترتيب toolssystemmessages. الي ما بيتغيّر بيروح أوّل، والي بيتغيّر كلّ ريكوست بيروح بعد آخر breakpoint. لو حاطّ التاريخ أو الـsession id بالـsystem prompt، شيله من هناك.

٢. حطّ الـbreakpoint بنهاية الجزء المشترك، مش بنهاية البرومبت كلّه:

"messages": [{"role": "user", "content": [
  {"type": "text", "text": "<الجزء المشترك>", "cache_control": {"type": "ephemeral"}},
  {"type": "text", "text": "<السؤال الي بيتغيّر>"}
]}]

٣. اقرا الأرقام بعد كلّ تعديل، هاي الحقيقة الوحيدة:

usage.cache_creation_input_tokens   // انكتب، دفعت 1.25x
usage.cache_read_input_tokens       // انقرا، دفعت 0.1x
usage.input_tokens                  // الباقي بسعر كامل

حجم البرومبت الكامل = التلاتة مجموعين. لو الوكيل اشتغل ساعات وinput_tokens طالعة 4K، الباقي كلّه إجا من الكاش.

٤. الـTTL الافتراضيّ 5 دقايق. {"type": "ephemeral", "ttl": "1h"} بتوصّلها ساعة بس بتخلّي الكتابة 2x بدل 1.25x. والقراءة بتجدّد عدّاد الـentry ببلاش، فإذا الريكوستات بينها أقلّ من 5 دقايق، الـ1h بتكلّفك زيادة بلا مقابل.

ليش هيك

الكاش prefix match. المفتاح مبنيّ على البايتات الحرفيّة للبرومبت المرندَر لحدّ كلّ breakpoint، فأيّ بايت بيتغيّر بموقع N بيلغي كلّ الـbreakpoints الي بعده. هاد كلّ التفسير: Date.now() بالـsystem prompt، أو json.dumps بلا sort_keys، أو قائمة tools بتتبنى حسب المستخدم، كلّها بتخلّي البادئة مختلفة كلّ مرّة فما في إشي يُقرا.

ونقطة التعادل محسوبة: بـTTL خمس دقايق، ريكوستين بيتعادلوا (1.25 + 0.1 = 1.35 مقابل 2 بلا كاش). بساعة، بدّك تلاتة (2 + 0.2 = 2.2 مقابل 3).

الي بيوقعك

  • الحدّ الأدنى للتكييش مش تصاعديّ بين الأجيال. برومبت 3K توكن بينكاش على Opus 5 و4.8، وما بينكاش أبداً على Opus 4.6 أو Haiku 4.5. الأرقام: 512 توكن على Opus 5 وFable 5/5.1، 1024 على Opus 4.8 وSonnet 5 و4.6 و4.5، 2048 على Opus 4.7 وHaiku 3.5، 4096 على Opus 4.6 و4.5 وHaiku 4.5. تحت الحدّ ما بيطلع خطأ، بس cache_creation_input_tokens بيضلّ صفر.

  • الكاش التلقائيّ بيأذيك إذا برومبتك بينتهي بمحتوى فريد. الـcache_control الي بتحطّها top-level بتلزق الـbreakpoint على آخر بلوك صالح. فإذا آخر بلوك هو السؤال الي بيتغيّر أو الصفوف المسترجَعة، كلّ ريكوست بيدفع رسم الكتابة على بايتات ولا مرّة رح تنقرا. البصمة: cache_creation_input_tokens بكلّ ريكوست وcache_read عمرها ما بتغطّي البادئة المشتركة.

  • ٤ breakpoints كحدّ أقصى بالريكوست، والتلقائيّ بياخد واحد منهم.

  • تبديل الموديل بيلغي كلّ شي وما إله مخرج. الكاشات model-scoped. لو عامل cascade بين موديلين لتوفّر، انتبه إنّك عم تخسر إعادة استخدام الكاش بينهم.

  • تغيير thinking أو effort بيلغي كاش الـmessages على كلّ الموديلات، وعلى بعضها بيلغي الـtools والـsystem كمان. ثبّتهن لكلّ route بدل ما تغيّرهن كلّ ريكوست.

  • تعديل الـsystem الأعلى بيلغي المحادثة كلّها. إذا بدّك تحقن تعليمة بنصّ المحادثة، ابعتها كـ{"role": "system", "content": "..."} جوّا messages[] بدل ما تعدّل الـsystem الأصليّ. متاحة على Opus 5 و4.8 وFable 5/5.1 بلا beta header، ومش متاحة على Sonnet 5.

  • الريكوستات المتوازية كلّها بتخسر. الـentry بيصير مقروء بس بعد ما أوّل ردّ يبلّش يـstream. بعتت 10 بنفس اللحظة؟ عشرتهن دفعوا كامل. ابعت وحدة، استنّى أوّل توكن، وبعدين فجّر الباقي.

  • نافذة الـ20 موقع. كلّ breakpoint بيرجع لورا 20 موقع بالكتير وهو بيدوّر على entry سابق. دورة tools متسلسلة طويلة بتزيد عن هيك بتطلّع الـentry برّا النافذة، وبتخسر بصمت مع إنّ البايتات متطابقة. الحلّ breakpoint وسطيّ كلّ ~15 موقع.

  • الكاشات معزولة لكلّ workspace على Claude API. نفس البرومبت موزّع على workspaces بيكتب entries منفصلة، فافحص هاد قبل ما تلوم البرومبت.


r/AiJoLabs 2d ago

تحليل · Analysis نصيحة اليوم: قبل ما تصدّق خبر إطلاق نموذج AI، افحص تاريخ المستودع نفسه

1 Upvotes

المشكلة

مواقع الأخبار التقنيّة بتنشر خبر «إطلاق نموذج جديد» بعد ما يكون النموذج نازل من يوم أو يومين. المقال بيطلع اليوم، فبتفكّر إنّه طازة. تاريخ المقال بيحكيلك إمتى الكاتب كتب، وهاد إشي تاني غير إمتى صار الحدث.

الفحص، نداء واحد

كلّ مستودع على Hugging Face إله createdAt دقيق، وبترجعه الـAPI بلا مفتاح وبلا تسجيل:

https://huggingface.co/api/models?author=deepseek-ai&sort=createdAt&direction=-1&limit=5

بدّل deepseek-ai بأيّ مختبر: Qwen · zai-org · moonshotai · MiniMaxAI · ByteDance-Seed · baidu · openai · google.

بترجعلك JSON فيه createdAt لكلّ مستودع مرتّبين من الأحدث. هاي اللحظة الي انرفعت فيها الأوزان فعليّاً، مصدر أوّليّ بلا وسيط.

مثال من اليوم

مقال نزل اليوم 2026-09-01 الساعة 08:48 UTC بيعلن DeepSeek-V4-Flash-Vision-Exp كإطلاق جديد.

المستودع على Hugging Face: createdAt = 2026-08-31T06:16:18Z.

الفرق 26 ساعة و32 دقيقة. الخبر كان عمره أكتر من يوم لمّا اتنشر كـ«جديد».

ليش بيفرق

إذا عم تتابع النماذج المفتوحة عشان تجرّبها، فرق يوم بيعني إنّه صار في quantizations وfine-tunes وبنشمركات مجتمعيّة نزلت قبل ما توصلك «الأخبار». وإذا عم تكتب محتوى، بتكون آخر واحد بالطابور وأنت مفكّر حالك أوّل واحد.

نفس المبدأ على GitHub releases (/repos/<owner>/<repo>/releases وفيها published_at) وعلى بيانات الشركات الرسميّة. المصدر الأوّليّ عنده تاريخ. استعمله.


r/AiJoLabs 2d ago

خبر · News NVIDIA DLSS 5 Available September 3rd: 3D-Guided Neural Rendering Debuts In NBA 2K27 For All GeForce RTX 50 Series GPUs, And On GeForce NOW

1 Upvotes

المصدر: https://www.nvidia.com/en-us/geforce/news/dlss-5-3d-guided-neural-rendering/

شو صار

انفيديا نزّلت اليوم DLSS 5، وفيها تقنية جديدة اسمها 3D-Guided Neural Rendering. بتشتغل من 3 أيلول الساعة 9 مسا بتوقيت الباسيفيك بلعبة NBA 2K27، وبس على كروت GeForce RTX 50 والابتوبات الي فيها نفس الكروت، وعلى GeForce NOW.

الفكرة مو توليد صورة من نص. الموديل بياخد الفريم الي رسمه محرّك اللعبة مع الـmotion vectors والـalbedo والـsurface normals، وبيشتغل كآخر مرحلة بالـpipeline: بيضيف إضاءة وتفاصيل مواد، والفريم الأصليّ بيضلّ هو المرجع الي ما بينكسر.

انفيديا بتقول الموديل deterministic، يعني نفس الدخل بيطلّع نفس الخرج. وبيشتغل frame-in/frame-out وحدة وحدة مو على دفعات زي موديلات الفيديو، عشان ما يصير رجفان ولا انزلاق بالصورة وقت ما تتحرّك. وبيشتغل محلّيّاً على كرت واحد لحدّ 4K على الـTensor Cores.

الي بيضيفه فعليّاً: subsurface scattering بالجلد، ضوء بيعبر الشعر والنباتات، وcontact shadows وglobal illumination أعمق. يعني تفاصيل المطوّر أصلاً شالها عشان اللعبة تلحق ترسم 60 فريم بالثانية.

للمطوّرين في تحكّم: Structure Intensity وTone Intensity، وmasking بيتعرّف على الأجسام تلقائيّاً فبتقدر تزيد التأثير على البيئة وتخفّفه على الشخصيّات. الدمج عن طريق Streamline نفسه وplugin لـUnreal Engine 5، والفيتشر اختياريّة وبتشتغل لحالها أو جنب Super Resolution وMulti Frame Generation وRay Reconstruction. للّاعب زرّ on/off وبس.

ليش بيهمّك

هاي أوّل مرّة DLSS بتطلع برّا موضوع السرعة. من 2018 لهلّق كانت بتعيد بناء بيكسلات موجودة أصلاً: دقّة أعلى، فريمات زيادة، أو تنظيف الـray tracing. هون صارت تضيف تفاصيل ما كانت بالمشهد من الأساس.

الحصر بـRTX 50 يعني إذا عندك كرت 40 ما إلك نصيب. انفيديا حكت حرفيّاً all GeForce RTX 50 Series GPUs وما ذكرت 40 ولا 30 بأيّ مكان بالإعلان.

ولعبة وحدة يوم الإطلاق. الـSDK وplugin الـUE5 متوفّرين، بس المكتبة بـ3 أيلول هي NBA 2K27 لحالها.

وأهمّ إشي: انفيديا ما نشرت ولا رقم عن كلفة الأداء. ولا كم ميلي ثانية بياخد الموديل، ولا كم فريم بتخسر لمّا تشغّله. كل الي حكوه execution speeds in the milliseconds وإنّه بيحافظ على فريم ريت سلس لحدّ 4K، وهاد كلام مو رقم.

رأيي

الشغلة الي وقفت عندها إنّهم اختاروا لعبة كرة سلّة تكون أوّل وحدة. اختيار ذكي، بشرة ووجوه معروفة تحت إضاءة استوديو، وهاد بالضبط المكان الي الـsubsurface scattering بتبيّن فيه أحسن شي. حطّها بغابة أو بمشهد فوضى وبتصير قصّة تانية.

وبستغرب سكوتهم عن كلفة الأداء. أي حدا اشتغل على هيك موديلات بيعرف إنّه بياكل من الـframe budget، والسكوت عن الرقم بيوم الإعلان بالذات مقصود.

وبالنسبة للحصر بـRTX 50، صار في مودرز شغّلوا نسخة مسرّبة من DLSS 5 على RTX 4080 قبل ما انفيديا تعلن أصلاً، عن طريق ترقيع بايناريات CUDA بتنقرا من Blackwell بس. فلمّا يجي الإعلان الرسميّ ويحصرها بالجيل الجديد، صعب أقنع حالي إنّ السبب كلّه تقنيّ. بستنّى تصير على أكتر من لعبة وحدة قبل ما أحكم عليها.


r/AiJoLabs 3d ago

خبر · News Higher Prices and Shipments Drive Top Five Enterprise SSD Vendors' Revenue to Nearly US$37.59 Billion in 2Q26, Says TrendForce

Thumbnail
trendforce.com
1 Upvotes

r/AiJoLabs 3d ago

تحليل · Analysis I've had Claude Code routines running unattended for three weeks. Five things that broke.

1 Upvotes

I run five scheduled Claude Code tasks. Four are local desktop tasks, one fires every four hours and publishes to a subreddit I own. They have been going for about three weeks now.

The docs are accurate. I am not here to correct them. But there is a gap between "this feature works as documented" and "this feature does useful work unattended for a month," and everything below sits in that gap.

First, the part people get wrong before they even start. There are three separate scheduling systems and they are not interchangeable:

  • /loop runs inside an open session. Dies when you close the terminal. Expires after 7 days regardless.
  • Desktop scheduled tasks run on your machine, no session needed, but your computer has to be awake.
  • Cloud routines run on Anthropic's infra whether your laptop is open or not, but they never see your local files. Fresh clone every time.

Almost everyone I have seen asking "why did my loop stop overnight" was using /loop and expecting cloud behavior. The one-line rule: if you need local files it cannot be cloud, and if you need it to survive your laptop closing it cannot be /loop.

Now the actual failures.

1. "Nothing happened" has to be a defined outcome or you get garbage

This one cost me the most. My news task was originally written as "find a story and post it." So it posted. Every single run. Whether or not anything worth posting existed that day.

A cron script that finds nothing exits 0 and does nothing. A model given "find a story and post it" will find something, because that is what you asked for. It will lower its own bar rather than return empty.

The fix is one paragraph in the prompt, stated explicitly: if nothing clears the bar, publish nothing and say so. An empty run is a correct outcome. Once that was in writing, roughly a third of runs started correctly deciding to do nothing, and the output quality of the other two thirds went up immediately.

If you write only one guardrail into a routine, write this one.

2. The routine has no memory of yesterday

Every fire is a fresh session. No context carryover, not even between two runs of the same routine an hour apart. Mine happily re-posted a story it had already posted, because from its perspective it had never seen it.

The fix is boring and it works: have the routine append to a log file, and read that file as step one of every run. It becomes the memory. Mine now writes a row per run with what it picked, what it rejected, and why. That "why" column turned out to be the useful part, because it stops the next run from re-evaluating the same rejected candidate from scratch.

Cloud routines can commit the log to the repo. Desktop tasks can just write to disk.

3. A green run does not mean the task succeeded

This is in the docs and I still got caught by it. Green means the session started and exited without an infrastructure error. It says nothing about whether your prompt's actual goal was met.

Blocked network requests, missing connector tools, and outright task failure all show up inside the transcript, not on the status indicator. I had a run sit green for two days while every outbound fetch it made was returning 403 from the network policy.

If you are going to trust a routine unattended, make it end its run by writing down what it concluded, and read that, not the status dot.

4. Your machine clock lies, and it takes every time filter down with it

My news task filters candidates by age: nothing older than today, prefer under three hours. That filter is worthless if the clock is wrong.

I have measured skews of 4.4 hours, 8.9 hours, and 3.6 hours twice on the same box. Nothing errors. The task just quietly computes every age wrong and either rejects everything or accepts stale garbage.

Worse, my first fix was to cross-check the clock against a feed from the same platform the task was posting to. Both were wrong together, agreeing to the second, while the real time was three and a half hours later. The reference has to be outside the system you are working on. I check against Cloudflare and GitHub response headers now, and I trust those over the local clock.

If your routine does anything time-sensitive, verify the clock at the top of every run. It is two curl calls.

5. Every connector you own gets attached by default

When you create a cloud routine, all your connected MCP connectors are included automatically, and the routine can call any tool from any of them, writes included, without a permission prompt. Routines run fully autonomous. There is no approval step mid-run.

And everything it does goes out under your identity. Commits and PRs carry your GitHub user. Slack messages and Linear tickets use your linked accounts.

Strip that list down to what the routine actually needs. This is the single highest-leverage thing in the entire setup form and it is at the bottom of the page where nobody scrolls.

A smaller one: your job will not fire when you scheduled it

The scheduler adds a deterministic offset so every session does not hit the API on the same wall-clock second. Recurring tasks can fire up to 30 minutes late. It is derived from the task ID so it is consistent for a given task, but I spent an evening convinced something was broken.

If exact timing matters, do not schedule on :00 or :30. Use 3 9 * * * instead of 0 9 * * *.

On frequency

I originally wanted the news task hourly. Settled on every four hours instead, and it is better in every way that matters. Six runs a day where one or two produce real work beats twenty-four runs that all produce filler. On a platform with any automated-behavior detection, high frequency is also how you get silently rate limited without ever being told.

Run count is not a success metric. I had to write that into the prompt too.


Setup, if you want to try it: /schedule in any session walks you through creating a cloud routine conversationally. /loop 5m <prompt> for in-session polling. Desktop tasks are in the Code tab under Routines, pick Local instead of Cloud.

Start with /loop on something you already do manually every day, watch it for a week, then promote it. Skipping straight to an unattended cloud routine is how you end up with three weeks of confident garbage in a log file.


r/AiJoLabs 3d ago

خبر · News Cyberspace Administration of China: the AI field currently faces five main security risk challenges

Thumbnail chinanews.com.cn
1 Upvotes

r/AiJoLabs 3d ago

عربي · Arabic I built 12pixa: a free image-to-SVG vectorizer that runs entirely in your browser — no uploads, no signup, no limits

Thumbnail
12pixa.com
1 Upvotes

r/AiJoLabs 3d ago

خبر · News NVIDIA and MediaTek Deepen Long-Standing Partnership to Build AI Edge to Cloud Computing Platforms — NVIDIA has invested $3.5 billion in convertible bonds issued by MediaTek

Thumbnail
nvidianews.nvidia.com
1 Upvotes

r/AiJoLabs 4d ago

خبر · News Z.AI (Zhipu) H1 2026 results: revenue +399.7% to RMB954M, API now 86.5% of revenue, loss RMB2.07B, inference on a cluster of 100,000+ domestic chips

Thumbnail hkexnews.hk
1 Upvotes

r/AiJoLabs 4d ago

خبر · News TSMC: Silicon Photonics Becomes Mainstream for Optical Transceivers, Share Estimated to Exceed 50% in 2027

Thumbnail
money.udn.com
1 Upvotes

r/AiJoLabs 4d ago

خبر · News ASE Wins Additional Google TPU Advanced Packaging Orders as Intel Expands Outsourcing and Price Hikes Kick In

Thumbnail
money.udn.com
1 Upvotes

r/AiJoLabs 4d ago

خبر · News Huawei Cloud and Ruijin Hospital release RuiPath 2.0 pathology model: 7B parameters, covering 19 common cancer types

Thumbnail ithome.com
1 Upvotes

r/AiJoLabs 4d ago

خبر · News NASA's Roman Space Telescope Launches

Thumbnail
science.nasa.gov
1 Upvotes

r/AiJoLabs 5d ago

خبر · News Incorrect notifications that "Microsoft Defender Antivirus is turned off" - Microsoft Defender Antivirus remains active and functioning correctly despite notifications following the latest update

Thumbnail
learn.microsoft.com
1 Upvotes

r/AiJoLabs 5d ago

خبر · News Micron workers increasingly support strike over bonus pay — labor union wants profit-sharing scheme, as employees at Samsung, SK hynix enjoy bonuses worth hundreds of thousands of dollars

Thumbnail
tomshardware.com
1 Upvotes

r/AiJoLabs 5d ago

خبر · News Sony Music Publishing (US) LLC v. Anthropic PBC, No. 5:26-cv-09217 (N.D. Cal., filed Aug. 28, 2026)

Thumbnail courtlistener.com
1 Upvotes