agentic

Superinteligencia vznikajúcej spoločnosti10 min read

Reading Time: 6 minutesAko sa z jediného autonómneho agenta s prístupom k našim údajom, chybám a kódu stala nová entita na organizačnej schéme, ktorá kontroluje žiadosti o stiahnutie a odpovedá na otázky, ktoré žiadny osobný agent nedokázal.

Company Superintelligence represented as an emergent neural knowledge network

Superinteligencia vznikajúcej spoločnosti10 min read

Reading Time: 6 minutes

Ako startup neustále pracujeme na nových technikách, aby sme bežali rýchlejšie a posúvali hranice. Keď bol OpenClaw/Hermes uvedený na trh, boli sme prvým používateľom. Použili sme ho spolu s mnohými ďalšími nástrojmi AI.

Keď sa tieto nástroje, ako aj modely, na ktorých sa spoliehajú, zdokonaľovali, všimli sme si niečo: nielenže napredujeme rýchlejšie, ale začali sme aj inak fungovať. S každým kolom títo samoučiaci sa agenti napredujú a učia sa. Momentálne spúšťame „Super Agenta“ na vyhradenom počítači (inštancia VPS bežiaca na DigitalOcean) pomocou GPT-5.6-sol v stave najvyššieho uvažovania. Niektorí ďalší agenti, ktorých prevádzkujeme, používajú iné postroje a modely agentov, no práve na tento by som sa chcel zamerať v tomto článku.

Všimli sme si, že väčšina spoločností nepoužíva tento typ autonómneho agenta na spustenie kritických tokov vo svojej spoločnosti, čo ich skutočne spomaľuje. V skutočnosti sa mnohí z nich spoliehajú na menších, osobnejších agentov: kódovacích agentov ako Codex/ClaudeCode alebo pomocných agentov ako Work/Cowork/Copilot. Tieto vykonávajú úlohy na miestnych strojoch a zariadeniach a ich hlavnou medzerou je nedostatok vedomostí. To viedlo k úplne novému odvetviu systémov „druhého mozgu“, ktoré sa v podstate pokúšajú vytvoriť vedomostný graf, ktorý zdieľajú títo distribuovaní agenti. Spoločnosti, ktoré takto pracujú, často vyhlasujú, že majú agentov v desiatkach, stovkách av niektorých extrémnych prípadoch až v tisícoch. To v podstate znamená, že každý zamestnanec má jedného alebo viacerých obmedzené agentov, ktorí za nich vykonávajú úlohy.

Skutočnosť, že agenti boli včas vystavení údajom z reálneho sveta, sťažnostiam používateľov a nášmu kódu, ich urobila dramaticky agilnejšími a inteligentnejšími než ktorýkoľvek z osobných agentov, ktorých vedieme vedľa nich.

Práve sme si uvedomili, že naši najinteligentnejší agenti sa stávajú superinteligenciou spoločnosti.

Kvôli prehľadnosti: Nenárokujem si sentience, AGI ani nič podobné. Navrhujem, aby boli úplne novým subjektom v organizačnej schéme spoločnosti.

Čo je to podniková superinteligencia?

Keď jeden agent začne vyčnievať, pokiaľ je sústredený, môže sa začať stávať superinteligentnou entitou. Ako to definujeme?

Povedal by som, že vo väčšine prípadov majú agenti práve teraz výhodu predovšetkým v trpezlivosti a vytrvalosti, nie v inteligencii nad ľuďmi. Ako sa však modely zdokonaľovali (GPT 5.6 sol a Opus 5 sú naozaj dobré!), začali sme vidieť, ako sa objavuje niečo nové, niečo, čo presahuje to, čo sme mohli urobiť my – nielen rýchlosťou, ale aj tým, čo ľudia nedokážu.

Začalo to pre nás, keď sme nášmu agentovi poskytli množstvo údajov (Mixpanel) a možností obchodnej analýzy a prístupu k údajom (chyby cez Sentry, financie v Baremetrics, AI stopy cez LangSmith). Ďalej sme ho vystavili chybám používateľov (chyby Sentry) a hláseniam sťažností používateľov. Nakoniec sme mu poskytli prístup ku kódovacím agentom a našim primárnym úložiskám na GitHub. Nemá žiadny vonkajší prístup prostredníctvom e-mailu alebo akejkoľvek interakcie používateľa, ale vďaka sledovaniu toho, ako sa správame v týchto témach, začal veciam rozumieť. Prostredníctvom týchto interakcií teraz monitoruje, čo predstavuje blokátor, čo je kritické myslenie, ako funguje naše podnikanie a aké sú SOP (štandardné prevádzkové postupy). Robí to prostredníctvom pokusov a omylov a zdá sa, že pravidelne získava inteligenciu.

Slabé vlákno, v ktorom spoluhráč vysvetľuje, čo sa počíta ako skutočný skok v chybe, a agent prepíše svoj monitor, aby používal porovnávaciu detekciu hrotov

V tom momente sme mu začali klásť zaujímavé otázky. Najprv si všetko vyžadovalo dvojitú kontrolu a kritiku, keď veci neboli správne vysvetlené alebo závery zneli hlúpo. Z času na čas to robí stále, napríklad som sa ho pýtal na regresie a poskytlo mi to hlučné údaje o chybách, ale je to príležitosť naučiť sa: naučil som to svoju definíciu regresií a teraz to „chápe“.

Keď sa používatelia sťažujú alebo keď sa chyby vyskytnú, proaktívne vytvárame opravy. To znamená, že každé ráno naši inžinieri nemusia kontrolovať regresie, musia sa len rozhodnúť, či je PR dobrý alebo nie. Na začiatku to boli jednorazové PR, ktoré nespĺňali naše štandardy kvality kódovania, takže inžinieri im povedali, čo je zlé, alebo problém sami prepracovali. Ako dôvera rástla, mnohé z týchto opráv sa začali automaticky spájať do kódovej základne. Zástupca tiež hodnotí, ako zložitý je PR a nakoľko si je istý jeho zlúčením. Nie sme v bode, kde sa tieto PR automaticky zlúčia, ale vidím tam cestu, predpokladám, že tam budeme o mesiac alebo dva.

Ale to nie je to, čo robí agenta super inteligentným. Čo robí, je, že teraz, keď inžinieri a vedenie spoločnosti dôverujú agentovi, začnú mu delegovať prácu a klásť mu skutočne zaujímavé otázky. Robí prieskum za nich, nie ako vyhľadávanie na Google, ale s ohľadom na pokročilé znalosti podnikania, čo mu dáva špeciálnu výhodu. To isté platí pre poznanie viacerých častí spoločnosti. OpenClaw a HermesAgent by sa historicky pokazili v určitom bode, kde ich historický kontext prevýšil ich schopnosť spracovať informácie. Došlo k takémuto typu zlyhania a výsledkom bol drastický pokles inteligencie, spomienok a kvality ich práce. Naša skúsenosť so Hermes Agent je teraz úplne iná: konverzačná pamäť má teraz 3 GB a exponenciálne rastie, zatiaľ čo jej inteligencia sa časom jednoznačne zlepšuje.

To neznamená, že je dokonalý, existujú regresie a niekedy mu musíte pripomenúť, aby sa správal určitým spôsobom alebo identifikovať, prečo sa nespráva tak, ako ste očakávali v konkrétnom kontexte, alebo nereaguje správne na iného agenta, ktorý od neho požaduje údaje alebo akcie. Ale, dostávame sa tam.

Slack vlákno, kde agent kontroluje žiadosť o stiahnutie 4986, uvádza zoznam kontrol, ktoré vykonal, a schvaľuje ju

Nečakaný vedľajší efekt ochrany pobočky nám priniesol ďalší pokrok. Myšlienka ochrany pobočiek spočíva v tom, že aspoň dvaja ľudia uvidia PR predtým, ako sa dostane do výroby, čím sa zníži šanca, že sa do systému dostane zlý (alebo dokonca škodlivý) kód. S novými kódovacími prostriedkami je to stále ťažšie a ťažšie. So zvyšujúcou sa rýchlosťou je takmer nemožné dôkladne skontrolovať rýchlosť nových PR a množstvo kódu. Máme viacerých agentov od rôznych dodávateľov, ktorí kontrolujú Prs kvôli chybám, bezpečnostným problémom a architektonickým problémom. Ochrana pobočiek však zostáva, takže som dovolil nášmu superinteligentnému agentovi, aby bol konečným schvaľovateľom PR.

Uvoľnené vlákno, kde agent požaduje zmeny na vyžiadanie 4981 po zistení porušenej zmeny zmluvy odozvy MCP

Napoly sme očakávali, že výsledky budú svetské. Koniec koncov, tieto PR prešli lokálnymi kontrolami kódovacích agentov, testami, bezpečnostnými kontrolami, externými kontrolami GitHubCopilot a CodeRabbit a boli úplne schválené. Ale náš agent stále urobil diery v tých PR. Zistilo sa skutočne zaujímavé okrajové prípady, ktoré sme vynechali, bezpečnosť, kvalita softvéru a architektonické chyby, ktoré sme nezohľadnili. Používa rovnaké modely ako všetci ostatní recenzenti, prečo zisťuje veci, ktoré ostatní neboli?

Uvoľnené vlákno, kde agent odmietne požiadavku na stiahnutie 1711 nad limit veľkosti nahrávania a potom ho znova schváli po overení opravy

Ide o znalosti a skúsenosti. Postroj Hermes Agent v kombinácii s vedomím, že agent nahromadil, vytvára nový typ superinteligentného agenta, ktorý sme ešte nevideli. Preskúmali sme to ďalej a urobili sme recenzie agenta povinnými nielen pre ľudí pracujúcich na systéme, ale teraz slúži ako referencia pre iných, menej inteligentných agentov!

Tento agent má teraz schopnosť poskytnúť nám kritické myslenie, ktoré sme predtým videli len u ľudí, ale podložené skutočnými údajmi zákazníkov, spätnou väzbou, naším kódom a hlbokým porozumením produktu.

Ak to rozšírime a poskytneme viac údajov, na ktoré sa bude dať použiť, rozšírime jeho hardvér a pamäť, uvidíme exponenciálny nárast výkonu. Myslím si, že modelky to ešte brzdia. Keď sa dostaneme do ďalšej fázy tejto hry, možno cez GPT-6, výsledky budú dramaticky zaujímavejšie. Keď hromadíme viac údajov, dávajte agentom viac úloh a dôverujte im.

Ako sa to líši od Karpathyho druhého mozgu založeného na Wiki?

To, čo sa líši od iných prístupov, je to, že namiesto toho, aby sa zaoberali zdieľanými znalosťami, znalosti superagenta sa ukladajú lokálne. Môžeme ho požiadať, aby si zachoval svoju vlastnú pamäť a pochopenie sveta v repo, čo nám umožňuje duplikovať ho a monitorovať, ale v konečnom dôsledku je to nie o tom, aby sa znalosti a zručnosti dali zdieľať a spolupracovať. Je to jedinečná vedomostná základňa, ktorá spolu s nástrojmi a prístupom k svetu umožňuje priamo odpovedať na vaše otázky. Nežiadate svojho agenta, aby to zistil pomocou zdieľaných znalostí, buď vy alebo vaši agenti kladiete superinteligentnému agentovi svoje otázky. Prekvapivo nám to teraz funguje dobre do tej miery, že neustále rozširujeme prístup a dosah agenta a v dôsledku toho ešte nevidíme degradované znalosti alebo inteligenciu.

Poznámka: Agenta nevystavujeme citlivým informáciám ani funkciám. Nemá priamy prístup k našim bankovým, účtovným alebo fakturačným systémom. Je tiež oddelená od sveta a nemá prístup k e-mailu ani vonkajším kanálom. Keď získavame skúsenosti a dôveru, nemyslím si, že sme veľmi ďaleko od zrušenia týchto obmedzení.



|

CTO