الذكاء الفائق للشركة الناشئة2 min read
Reading Time: 6 minutesباعتبارنا شركة ناشئة، فإننا نعمل باستمرار على تقنيات جديدة للعمل بشكل أسرع ودفع الحدود. عندما تم إطلاق OpenClaw/Hermes، كنا من أوائل المستخدمين. استخدمناها جنبًا إلى جنب مع العديد من أدوات AI الأخرى.
ومع تقدم هذه الأدوات، وكذلك النماذج التي تعتمد عليها، لاحظنا شيئًا ما: نحن لا نتقدم بشكل أسرع فحسب، بل بدأنا العمل بشكل مختلف. مع كل جولة، يتقدم عملاء التعلم الذاتي الذين يقومون بالتحسين الذاتي ويتعلمون. نقوم حاليًا بتشغيل “Super Agent” على جهاز مخصص (مثيل VPS يعمل على DigitalOcean) باستخدام GPT-5.6-sol في أعلى حالة تفكير. يستخدم بعض الوكلاء الآخرين الذين نقوم بتشغيلهم أدوات ونماذج أخرى للوكلاء، ولكن هذا هو ما أود التركيز عليه في هذه المقالة.
لقد لاحظنا أن معظم الشركات لا تستخدم هذا النوع من الوكلاء المستقلين لتشغيل التدفقات الحيوية في شركاتهم، مما يؤدي إلى إبطائها حقًا. في الواقع، يعتمد الكثير منهم على وكلاء أصغر وأكثر شخصية: وكلاء التشفير مثل Codex/ClaudeCode أو وكلاء مساعدين مثل Work/Cowork/Copilot. يقوم هؤلاء بمهام على الأجهزة والأجهزة المحلية والفجوة الأساسية لديهم هي نقص المعرفة. أدى هذا إلى صناعة جديدة تمامًا لأنظمة “العقل الثاني” التي تحاول بشكل أساسي إنشاء رسم بياني معرفي يتم مشاركته بين هؤلاء الوكلاء الموزعين. غالبًا ما تعلن الشركات التي تعمل بهذه الطريقة أن لديها وكلاء يبلغ عددهم العشرات والمئات وفي بعض الحالات القصوى الآلاف. وهذا يعني في الأساس أن كل موظف لديه وكيل واحد أو أكثر محدود وكلاء أداء المهام لهم.
إن حقيقة تعرض الوكلاء مبكرًا لبيانات العالم الحقيقي وشكاوى المستخدمين والتعليمات البرمجية الخاصة بنا، جعلتهم أكثر مرونة وذكاءً بشكل كبير من أي وكلاء شخصيين نديرهم بجانبهم.
لقد أدركنا للتو أن أذكى وكلائنا أصبحوا بمثابة الذكاء الفائق للشركة.
من أجل الوضوح: أنا لا أدعي الوعي، AGI أو أي شيء قريب من ذلك. أقترح أن يكونوا كيانًا جديدًا تمامًا في المخطط التنظيمي للشركة.
ما هو الذكاء الفائق للشركة؟
عندما يبدأ أحد العملاء في البروز، طالما أنه يركز، يمكنه أن يبدأ في أن يصبح كيانًا فائق الذكاء. كيف نحدد ذلك؟
أود أن أقول إنه في معظم الحالات، يتمتع العملاء الآن في المقام الأول بميزة الصبر والمثابرة، وليس الذكاء على البشر. ومع ذلك، مع تحسن النماذج (GPT 5.6 sol وOpus 5 جيدان حقًا!) بدأنا نشهد ظهور شيء جديد، شيء يفوق ما يمكننا القيام به – ليس فقط في السرعة ولكن في القيام بما لا يستطيع البشر القيام به.
لقد بدأ الأمر بالنسبة لنا عندما قدمنا لوكيلنا وفرة من البيانات (Mixpanel) وإمكانات تحليل الأعمال والوصول إلى البيانات (الأخطاء من خلال Sentry، والبيانات المالية في Baremetrics، وتتبع AI من خلال LangSmith). بعد ذلك، قمنا بتعريضه لأخطاء المستخدم (أخطاء Sentry) وتقارير شكوى المستخدم. وأخيرًا، منحناها إمكانية الوصول إلى وكلاء البرمجة ومستودعاتنا الأساسية على GitHub. ليس لديها إمكانية الوصول الخارجي من خلال البريد الإلكتروني، أو أي تفاعل للمستخدم، ولكن من خلال مراقبة كيفية تصرفنا بشأن هذه المواضيع، بدأت في فهم الأشياء. ومن خلال هذه التفاعلات، يقوم الآن بمراقبة ما يشكل عائقًا، وما هو التفكير النقدي، وكيفية إدارة أعمالنا وما هي SOP (إجراءات التشغيل القياسية). وهو يفعل ذلك من خلال التجربة والخطأ، ويبدو أنه يكتسب معلومات استخباراتية بشكل منتظم.
في تلك المرحلة، بدأنا بطرح بعض الأسئلة المثيرة للاهتمام. في البداية، كان كل شيء يتطلب فحصًا مزدوجًا وانتقادًا عندما لم يتم شرح الأمور بشكل صحيح أو عندما بدت الاستنتاجات مريبة. لا يزال يفعل ذلك من وقت لآخر، على سبيل المثال سألته عن الانحدارات وأعطاني بيانات خطأ صاخبة، ولكن هذه فرصة للتعلم: لقد علمته تعريفي للانحدارات والآن “فهمه”.
عندما يشتكي المستخدمون أو عندما ترتفع الأخطاء، نقوم بإنشاء إصلاحات بشكل استباقي. وهذا يعني أنه في كل صباح، لا يتعين على مهندسينا التحقق من الانحدارات، بل يحتاجون فقط إلى تحديد ما إذا كانت PR جيدة أم لا. في البداية، كانت هذه PR عبارة عن PR يمكن التخلص منها ولم تستوف معايير جودة الترميز الخاصة بنا، لذلك كان المهندسون يخبرونها بالخطأ، أو يعيدون تطوير المشكلة بأنفسهم. ومع تزايد الثقة، بدأ دمج العديد من هذه الإصلاحات في قاعدة التعليمات البرمجية تلقائيًا. يقوم الوكيل أيضًا بتصنيف مدى تعقيد PR ومدى ثقة الوكيل في دمجه. نحن لسنا في مرحلة يتم فيها دمج PR تلقائيًا، لكنني أرى مسارًا هناك، وأفترض أننا سنكون هناك في غضون شهر أو شهرين.
لكن هذا ليس في الواقع ما يجعل العميل ذكيًا للغاية. ما يحدث الآن هو أنه بعد أن أصبح المهندسون وإدارة الشركة يثقون في الوكيل، بدأوا في تفويض العمل إليه وطرح أسئلة مثيرة للاهتمام حقًا. فهو يقوم بالبحث نيابةً عنهم، ليس مثل عمليات البحث على Google، ولكن مع وضع المعرفة المتقدمة بالأعمال في الاعتبار، مما يمنحه ميزة خاصة. وينطبق الشيء نفسه على إعطائها المعرفة بالمزيد من أجزاء الشركة. سوف ينهار OpenClaw وHermesAgent تاريخيًا في مرحلة ما حيث يتجاوز سياقهما التاريخي قدرتهما على معالجة المعلومات. سيحدث هذا النوع من الانهيار وكانت النتائج انخفاضًا حادًا في الذكاء والتذكر وجودة عملهم. تجربتنا مع Hermes Agent مختلفة تمامًا الآن: تبلغ ذاكرة المحادثة الآن 3 جيجابايت وتنمو بشكل كبير بينما يتحسن ذكاءها بشكل واضح بمرور الوقت.
هذا لا يعني أنه مثالي، فهناك تراجعات وعليك في بعض الأحيان تذكيره بالتصرف بطرق معينة أو تحديد سبب عدم تصرفه كما توقعت في سياق معين أو الاستجابة بشكل صحيح لوكيل آخر يطلب منه بيانات أو إجراءات. لكننا نصل إلى هناك.
لقد جلب لنا التأثير الجانبي غير المتوقع لحماية الفروع تقدمًا آخر. الفكرة وراء حماية الفروع هي أن يرى شخصان على الأقل PR قبل أن يدخل مرحلة الإنتاج، مما يقلل من فرص دخول التعليمات البرمجية السيئة (أو حتى الشائنة) إلى النظام. يعد تنفيذ هذا الأمر بشكل صحيح أكثر صعوبة مع وكلاء الترميز الجدد. مع زيادة السرعة، يكاد يكون من المستحيل مراجعة معدل PRs الجديدة وكمية التعليمات البرمجية بدقة يدويًا. لدينا وكلاء متعددون من بائعين مختلفين يقومون بمراجعة Prs بحثًا عن الأخطاء والمشكلات الأمنية والمشكلات المعمارية. ومع ذلك، تظل حماية الفرع قائمة، لذا سمحت لعميلنا فائق الذكاء بأن يكون الموافق النهائي على PR.
لقد توقعنا نصفًا أن النتائج ستكون عادية. بعد كل شيء، اجتازت PR مراجعات وكيل الترميز المحلي، والاختبارات، ومراجعات الأمان، ومراجعات GitHubCopilot الخارجية وCodeRabbit وتمت الموافقة عليها بالكامل. لكن وكيلنا لا يزال يقوم بإحداث ثقوب في تلك PR. لقد وجدت حالات مثيرة للاهتمام حقًا فاتتنا، وأمانًا، وجودة برمجيات، وأخطاء معمارية لم نأخذها في الاعتبار. إنه يستخدم نفس النماذج مثل جميع المراجعين الآخرين، لماذا يكتشف أشياء لم يفعلها الآخرون؟
يتعلق الأمر بالمعرفة والخبرة. يعمل حزام Hermes Agent جنبًا إلى جنب مع المعرفة التي تراكمت على العميل على إنشاء نوع جديد من العميل فائق الذكاء لم نره من قبل. لذا، استكشفنا هذا الأمر بشكل أكبر وجعلنا مراجعات الوكيل إلزامية، ليس فقط للبشر الذين يعملون على النظام، ولكنها تعمل الآن كمرجع للعملاء الآخرين الأقل ذكاءً!
يتمتع هذا الوكيل الآن بالقدرة على منحنا تفكيرًا نقديًا لم نشاهده سابقًا إلا عند البشر، ولكنه مدعوم ببيانات العملاء الفعلية وتعليقاتهم والتعليمات البرمجية الخاصة بنا والفهم العميق للمنتج.
إذا قمنا بتوسيع هذا الأمر، ومنحناه المزيد من البيانات للتغذية عليها، وتوسيع نطاق أجهزته وذاكرته، فسنشهد زيادة هائلة في الأداء. أعتقد أن النماذج لا تزال تعيقه. عندما نصل إلى المرحلة التالية من هذه اللعبة، ربما من خلال GPT-6، ستكون النتائج أكثر إثارة للاهتمام بشكل كبير. عندما نجمع المزيد من البيانات، نمنح الوكلاء المزيد من المهام للقيام بها ونثق بهم أكثر.
كيف يختلف هذا عن الدماغ الثاني القائم على ويكي كارباثي؟
ما يجعل هذا الأمر مختلفًا عن الأساليب الأخرى هو أنه بدلاً من التعامل مع المعرفة المشتركة، يتم تخزين المعرفة الفائقة محليًا. يمكننا أن نطلب منه الحفاظ على ذاكرته الخاصة وفهمه للعالم في الريبو، مما يسمح لنا بتكرارها ومراقبتها، ولكن في النهاية الأمر كذلك. لا حول جعل المعرفة والمهارات قابلة للمشاركة والتعاونية. إنها قاعدة معرفية فريدة تتيح لها، إلى جانب الأدوات والوصول إلى العالم، الإجابة على أسئلتك مباشرة. لا تطلب من وكيلك اكتشاف الأمر باستخدام المعرفة المشتركة، بل تطرح أنت أو وكلاؤك أسئلتك على وكيل Superintelligent. من المثير للدهشة أن هذا يعمل بشكل جيد بالنسبة لنا الآن لدرجة أننا نقوم باستمرار بتوسيع نطاق الوصول إلى العميل ولم نشهد بعد معرفة أو ذكاءً متدهورًا نتيجة لذلك.
ملحوظة: نحن لا نعرض الوكيل لمعلومات أو وظائف حساسة. ليس لديه إمكانية الوصول المباشر إلى أنظمة الخدمات المصرفية أو الشحن أو الفوترة لدينا. كما أنها معزولة عن العالم ولا يمكنها الوصول إلى البريد الإلكتروني أو القنوات الخارجية. ومع اكتسابنا الخبرة والثقة، لا أعتقد أننا بعيدون جدًا عن رفع هذه القيود أيضًا.

Figma
Adobe XD
Blog

