agentic

ความฉลาดหลักแหลมของบริษัทที่เกิดขึ้นใหม่2 min read

Reading Time: 2 minutesวิธีที่ตัวแทนอิสระเพียงรายเดียวที่สามารถเข้าถึงข้อมูล ข้อผิดพลาด และโค้ดของเรากลายเป็นเอนทิตีใหม่ในแผนผังองค์กร โดยตรวจสอบคำขอดึงข้อมูล และตอบคำถามที่ไม่มีตัวแทนส่วนบุคคลสามารถทำได้

  • สิงหาคม 13, 2026 2 min read
Company Superintelligence represented as an emergent neural knowledge network

ความฉลาดหลักแหลมของบริษัทที่เกิดขึ้นใหม่2 min read

Reading Time: 2 minutes

ในฐานะสตาร์ทอัพ เรากำลังพัฒนาเทคนิคใหม่ๆ อย่างต่อเนื่องเพื่อให้ทำงานได้เร็วขึ้นและก้าวข้ามขีดจำกัด เมื่อ OpenClaw/Hermes เปิดตัว เราก็เป็นผู้ใช้กลุ่มแรกๆ เราใช้มันร่วมกับเครื่องมือ AI อื่นๆ อีกมากมาย

เนื่องจากเครื่องมือเหล่านี้ ตลอดจนโมเดลที่เครื่องมือเหล่านี้พึ่งพา มีความก้าวหน้า เราสังเกตเห็นบางอย่าง: เราไม่เพียงแค่ก้าวหน้าเร็วขึ้นเท่านั้น แต่เราได้เริ่มทำงานที่แตกต่างออกไปด้วย ในแต่ละรอบ ตัวแทนการเรียนรู้ด้วยตนเองที่ปรับปรุงตนเองเหล่านี้กำลังก้าวหน้าและการเรียนรู้ ขณะนี้เรากำลังใช้งาน “Super Agent” บนเครื่องเฉพาะ (อินสแตนซ์ VPS ที่ทำงานบน DigitalOcean) โดยใช้ GPT-5.6-sol ในสถานะการให้เหตุผลสูงสุด เจ้าหน้าที่อื่นๆ บางส่วนที่เรากำลังดำเนินการอยู่นั้นใช้สายรัดและโมเดลของตัวแทนอื่นๆ แต่นี่คือตัวที่ฉันต้องการเน้นในบทความนี้

เราสังเกตเห็นว่าบริษัทส่วนใหญ่ไม่ได้ใช้ตัวแทนอัตโนมัติประเภทนี้เพื่อดำเนินการกระแสสำคัญในบริษัทของตน ซึ่งทำให้การดำเนินการช้าลงอย่างมาก ในความเป็นจริง หลายๆ คนพึ่งพาตัวแทนที่มีขนาดเล็กและเป็นส่วนตัวมากกว่า: เอเจนต์การเขียนโค้ด เช่น Codex/ClaudeCode หรือเอเจนต์ผู้ช่วย เช่น Work/Cowork/Copilot สิ่งเหล่านี้ทำงานบนเครื่องจักรและอุปกรณ์ในพื้นที่ และช่องว่างหลักที่พวกเขามีคือการขาดความรู้ สิ่งนี้นำไปสู่อุตสาหกรรมใหม่ทั้งหมดของระบบ “สมองที่สอง” ที่พยายามสร้างกราฟความรู้ที่ใช้ร่วมกันระหว่างตัวแทนที่กระจายเหล่านี้ บริษัทที่ทำงานในลักษณะนี้มักจะประกาศว่าตนมีตัวแทนเป็นสิบ ร้อย และในบางกรณีร้ายแรงเป็นพัน นั่นหมายความว่าพนักงานแต่ละคนมีตั้งแต่หนึ่งคนขึ้นไป จำกัด ตัวแทนที่ปฏิบัติงานให้พวกเขา

ความจริงที่ว่าตัวแทนถูกเปิดเผยตั้งแต่เนิ่นๆ ด้วยข้อมูลจริง ข้อร้องเรียนจากผู้ใช้ และโค้ดของเรา ทำให้พวกเขามีความคล่องตัวและชาญฉลาดมากกว่าตัวแทนส่วนตัวรายใดที่เราร่วมงานเคียงข้างพวกเขาอย่างมาก

เราเพิ่งตระหนักว่าตัวแทนที่ฉลาดที่สุดของเรากำลังกลายเป็นหน่วยสืบราชการลับของบริษัท

เพื่อความชัดเจน: ฉันไม่ได้อ้างความรู้สึก, AGI หรืออะไรทำนองนั้น ฉันกำลังเสนอว่าพวกเขาเป็นองค์กรใหม่ในแผนผังองค์กรของบริษัท

Superintelligence ของบริษัทคืออะไร?

เมื่อเจ้าหน้าที่คนหนึ่งเริ่มโดดเด่น ตราบใดที่มีสมาธิ ก็สามารถเริ่มกลายเป็นหน่วยงานที่ชาญฉลาดได้ เราจะกำหนดสิ่งนั้นได้อย่างไร?

ฉันจะบอกว่าในกรณีส่วนใหญ่ เจ้าหน้าที่ในตอนนี้มีข้อได้เปรียบในด้านความอดทนและความพากเพียรเป็นหลัก ไม่ใช่ความฉลาดเหนือมนุษย์ อย่างไรก็ตาม เมื่อโมเดลต่างๆ ดีขึ้น (GPT 5.6 sol และ Opus 5 ดีจริงๆ!) เราเริ่มเห็นสิ่งใหม่ๆ เกิดขึ้น ซึ่งเป็นสิ่งที่เหนือกว่าสิ่งที่เราสามารถทำได้ ไม่ใช่แค่ในเรื่องความเร็ว แต่ในการทำโดยมนุษย์ไม่สามารถทำได้

มันเริ่มต้นสำหรับเราเมื่อเรามอบความสามารถด้านข้อมูล (Mixpanel) และการวิเคราะห์ธุรกิจและการเข้าถึงข้อมูลให้กับตัวแทนของเรา (ข้อผิดพลาดผ่าน Sentry การเงินใน Baremetrics ติดตาม AI ผ่าน LangSmith) ต่อไป เราได้เปิดเผยข้อบกพร่องของผู้ใช้ (ข้อผิดพลาด Sentry) และรายงานการร้องเรียนของผู้ใช้ ในที่สุด เราก็ให้สิทธิ์การเข้าถึงแก่ตัวแทนการเขียนโค้ดและ Repos หลักของเราบน GitHub ไม่มีการเข้าถึงจากภายนอกผ่านทางอีเมลหรือการโต้ตอบของผู้ใช้ แต่จากการดูพฤติกรรมของเราในหัวข้อเหล่านี้ มันจึงเริ่มเข้าใจสิ่งต่างๆ ผ่านการโต้ตอบเหล่านี้ ตอนนี้จะตรวจสอบสิ่งที่ถือเป็นตัวบล็อก การคิดเชิงวิพากษ์คืออะไร ธุรกิจของเราดำเนินไปอย่างไร และ SOP (ขั้นตอนการปฏิบัติงานมาตรฐาน) คืออะไร ทำได้ผ่านการลองผิดลองถูกและดูเหมือนว่าจะได้รับสติปัญญาอยู่เป็นประจำ

เธรดหย่อนซึ่งเพื่อนร่วมทีมอธิบายสิ่งที่นับเป็นการขัดขวางข้อผิดพลาดจริง และตัวแทนเขียนการตรวจสอบใหม่เพื่อใช้การตรวจจับการขัดขวางเชิงเปรียบเทียบ

เมื่อถึงจุดนั้น เราเริ่มถามคำถามที่น่าสนใจ ในตอนแรก ทุกอย่างจำเป็นต้องมีการตรวจสอบและวิพากษ์วิจารณ์ซ้ำอีกครั้งเมื่อสิ่งต่าง ๆ ได้รับการอธิบายไม่ถูกต้องหรือข้อสรุปฟังดูคาว มันยังคงทำเช่นนี้เป็นครั้งคราว เช่น ฉันถามมันเกี่ยวกับการถดถอย และมันให้ข้อมูลข้อผิดพลาดที่มีเสียงดัง แต่นั่นเป็นโอกาสในการเรียนรู้: ฉันสอนมันเกี่ยวกับคำจำกัดความของการถดถอย และตอนนี้มัน “เข้าใจแล้ว”

เมื่อผู้ใช้ร้องเรียนหรือเมื่อมีข้อผิดพลาดเพิ่มขึ้น เราจะสร้างการแก้ไขในเชิงรุก นั่นหมายความว่าทุกเช้า วิศวกรของเราไม่จำเป็นต้องตรวจสอบการถดถอย พวกเขาแค่ต้องตัดสินใจว่า PR ดีหรือไม่ ในตอนแรก PR เหล่านี้เป็นแบบใช้แล้วทิ้งซึ่งไม่เป็นไปตามมาตรฐานคุณภาพการเขียนโค้ดของเรา ดังนั้นวิศวกรจึงสามารถแจ้งได้ว่ามีอะไรผิดปกติ หรือเพียงพัฒนาปัญหาขึ้นใหม่ด้วยตนเอง เมื่อความไว้วางใจเพิ่มมากขึ้น การแก้ไขเหล่านี้จำนวนมากก็เริ่มถูกรวมเข้ากับโค้ดเบสโดยอัตโนมัติ เอเจนต์ยังจัดอันดับความซับซ้อนของ PR และความมั่นใจของเอเจนต์ในการรวมเข้าด้วยกัน เรายังไม่ถึงจุดที่ PR เหล่านี้ถูกรวมเข้าด้วยกันโดยอัตโนมัติ แต่ฉันเห็นเส้นทางตรงนั้น ฉันคิดว่าเราจะไปถึงที่นั่นในอีกหนึ่งหรือสองเดือน

แต่นั่นไม่ใช่สิ่งที่ทำให้เจ้าหน้าที่ฉลาดสุดๆ ตอนนี้วิศวกรและฝ่ายบริหารของบริษัทมีความไว้วางใจในตัวตัวแทนแล้ว พวกเขาก็เริ่มมอบหมายงานให้กับตัวแทนและถามคำถามที่น่าสนใจจริงๆ ทำการค้นคว้าให้พวกเขา ไม่เหมือนกับการค้นหาใน Google แต่คำนึงถึงความรู้ขั้นสูงของธุรกิจ ซึ่งให้ความได้เปรียบเป็นพิเศษ เช่นเดียวกับการให้ความรู้ในส่วนอื่นๆ ของบริษัท OpenClaw และ HermesAgent ในอดีตจะพังทลายลง ณ จุดหนึ่งซึ่งบริบททางประวัติศาสตร์ของพวกเขาเกินความสามารถในการประมวลผลข้อมูล การพังทลายแบบนั้นจะเกิดขึ้น และผลลัพธ์ที่ได้คือความฉลาด ความทรงจำ และคุณภาพของงานลดลงอย่างมาก ประสบการณ์ของเรากับ Hermes Agent ค่อนข้างแตกต่างในขณะนี้: หน่วยความจำการสนทนาขณะนี้อยู่ที่ 3GB และเพิ่มขึ้นแบบทวีคูณ ในขณะที่ความฉลาดของมันก็ดีขึ้นอย่างเห็นได้ชัดเมื่อเวลาผ่านไป

ไม่ได้หมายความว่ามันสมบูรณ์แบบ มีการถดถอย และบางครั้งคุณต้องเตือนให้มันทำงานในลักษณะใดลักษณะหนึ่ง หรือระบุว่าเหตุใดจึงไม่ทำงานตามที่คุณคาดหวังในบริบทเฉพาะ หรือตอบสนองอย่างถูกต้องต่อตัวแทนอื่นที่ร้องขอข้อมูลหรือการดำเนินการจากมัน แต่เรากำลังไปถึงที่นั่น

Slack Thread ที่ตัวแทนตรวจสอบคำขอดึง 4986 แสดงรายการเช็คที่รันและอนุมัติ

ผลข้างเคียงที่ไม่คาดคิดของการป้องกันสาขาทำให้เราก้าวหน้าไปอีกขั้น แนวคิดเบื้องหลังการป้องกันสาขาก็คือ อย่างน้อยสองคนจะเห็น PR ก่อนที่จะเริ่มใช้งานจริง ซึ่งช่วยลดโอกาสที่โค้ดที่ไม่ดี (หรือชั่วร้าย) จะเข้าสู่ระบบได้ สิ่งนี้ยากขึ้นเรื่อยๆ ที่จะทำอย่างถูกต้องกับเอเจนต์การเขียนโค้ดใหม่ เมื่อความเร็วเพิ่มขึ้น อัตราของ PR ใหม่และปริมาณของโค้ดแทบจะเป็นไปไม่ได้เลยที่จะตรวจสอบด้วยมืออย่างละเอียด เรามีตัวแทนหลายรายจากผู้ขายที่แตกต่างกัน ตรวจสอบ Prs เพื่อหาจุดบกพร่อง ปัญหาด้านความปลอดภัย และปัญหาทางสถาปัตยกรรม อย่างไรก็ตาม การป้องกันสาขายังคงอยู่ ดังนั้นฉันจึงอนุญาตให้ตัวแทนอัจฉริยะของเราเป็นผู้อนุมัติขั้นสุดท้ายของ PR

Slack Thread ที่เอเจนต์ร้องขอการเปลี่ยนแปลงในคำขอดึง 4981 หลังจากพบการเปลี่ยนแปลงที่สำคัญในสัญญาตอบกลับ MCP

เราคาดหวังไว้ครึ่งหนึ่งว่าผลลัพธ์จะเป็นเรื่องธรรมดา ท้ายที่สุดแล้ว PR เหล่านี้ผ่านการรีวิว การทดสอบ การตรวจสอบความปลอดภัย การตรวจสอบ GitHubCopilot และ CodeRabbit จากภายนอก และได้รับการอนุมัติอย่างสมบูรณ์ แต่ตัวแทนของเรายังคงเจาะรูใน PR เหล่านั้น พบกรณี Edge ที่น่าสนใจจริงๆ ที่เราพลาดไป ความปลอดภัย คุณภาพซอฟต์แวร์ และข้อบกพร่องทางสถาปัตยกรรมที่เราไม่ได้พิจารณา มันใช้โมเดลเดียวกันกับผู้วิจารณ์คนอื่นๆ ทำไมมันถึงค้นหาสิ่งที่คนอื่นไม่ใช่?

เธรดหย่อนซึ่งตัวแทนปฏิเสธคำขอดึง 1711 เกินขีดจำกัดขนาดการอัปโหลด จากนั้นอนุมัติอีกครั้งเมื่อการแก้ไขได้รับการตรวจสอบแล้ว

มันขึ้นอยู่กับความรู้และประสบการณ์ ชุดควบคุม Hermes Agent ผสมผสานกับความรู้ที่เจ้าหน้าที่สั่งสมมาทำให้เกิดเจ้าหน้าที่อัจฉริยะชนิดใหม่ที่เราไม่เคยเห็นมาก่อน ดังนั้นเราจึงสำรวจเรื่องนี้เพิ่มเติมและบังคับให้เจ้าหน้าที่ตรวจสอบ ไม่ใช่แค่สำหรับมนุษย์ที่ทำงานบนระบบเท่านั้น แต่ตอนนี้ทำหน้าที่เป็นข้อมูลอ้างอิงสำหรับเจ้าหน้าที่อื่นๆ ที่ฉลาดน้อยกว่าด้วย!

ขณะนี้ตัวแทนนี้มีความสามารถในการคิดอย่างมีวิจารณญาณซึ่งก่อนหน้านี้เราเห็นในมนุษย์เท่านั้น แต่ได้รับการสนับสนุนจากข้อมูลลูกค้าจริง ข้อเสนอแนะ รหัสของเรา และความเข้าใจอย่างลึกซึ้งเกี่ยวกับผลิตภัณฑ์

หากเราขยายเรื่องนี้ และให้ข้อมูลมากขึ้นเพื่อป้อน ปรับขนาดฮาร์ดแวร์และหน่วยความจำ เราจะเห็นประสิทธิภาพเพิ่มขึ้นแบบทวีคูณ ฉันคิดว่านางแบบยังคงรั้งมันไว้ เมื่อเราเข้าสู่ช่วงต่อไปของเกมนี้ อาจจะผ่าน GPT-6 ผลลัพธ์จะน่าสนใจยิ่งขึ้นอย่างมาก เมื่อเราสะสมข้อมูลมากขึ้น ให้มอบหมายงานให้เจ้าหน้าที่ทำและไว้วางใจได้มากขึ้น

สิ่งนี้แตกต่างจากสมองที่ 2 ที่ใช้ Wiki ของ Karpathy อย่างไร

สิ่งที่ทำให้สิ่งนี้แตกต่างจากแนวทางอื่นๆ ก็คือ แทนที่จะจัดการกับความรู้ที่แบ่งปัน ความรู้ที่เป็นตัวแทนระดับสูงจะถูกจัดเก็บไว้ในเครื่อง เราสามารถขอให้มันรักษาความทรงจำของตัวเองและความเข้าใจโลกใน repo ซึ่งช่วยให้เราสามารถทำซ้ำและตรวจสอบมันได้ แต่ท้ายที่สุดแล้ว ไม่ เกี่ยวกับการแบ่งปันความรู้และทักษะและการทำงานร่วมกัน เป็นฐานความรู้เดี่ยวที่เมื่อรวมกับเครื่องมือและการเข้าถึงโลกแล้ว ให้ตอบคำถามของคุณโดยตรง คุณไม่ได้ขอให้ตัวแทนของคุณคิดออกโดยใช้ความรู้ที่มีร่วมกัน ไม่ว่าคุณหรือตัวแทนของคุณจะถามคำถามของคุณกับตัวแทนอัจฉริยะก็ตาม น่าแปลกที่วิธีนี้ใช้ได้ผลดีสำหรับเราในตอนนี้จนถึงจุดที่เราขยายการเข้าถึงและการเข้าถึงของตัวแทนอย่างต่อเนื่อง และเรายังไม่เห็นผลลัพธ์ที่ตามมาคือความรู้หรือสติปัญญาที่เสื่อมโทรม

หมายเหตุ: เราจะไม่เปิดเผยข้อมูลหรือฟังก์ชันที่ละเอียดอ่อนแก่ตัวแทน ไม่มีการเข้าถึงโดยตรงไปยังระบบธนาคาร การเรียกเก็บเงิน หรือการเรียกเก็บเงินของเรา นอกจากนี้ยังแยกออกจากโลกและไม่สามารถเข้าถึงอีเมลหรือช่องทางภายนอกได้ เมื่อเราได้รับประสบการณ์และความไว้วางใจ ฉันไม่คิดว่าเราจะห่างไกลจากการยกเลิกข้อจำกัดเหล่านี้มากนัก



|

CTO