Uusi yritys superäly8 min read
Reading Time: 5 minutesStartup-yrityksenä työskentelemme jatkuvasti uusien tekniikoiden parissa, jotta voimme ajaa nopeammin ja ylittää rajoja. Kun OpenClaw/Hermes lanseerattiin, olimme varhainen käyttöönotto. Käytimme sitä monien muiden AI-työkalujen kanssa.
Kun nämä työkalut ja mallit, joihin ne perustuvat, kehittyivät, huomasimme jotain: emme vain edisty nopeammin, vaan olemme alkaneet toimia eri tavalla. Jokaisella kierroksella nämä itseään parantavat itseoppivat agentit edistyvät ja oppivat. Käytämme tällä hetkellä ”Super Agenttia” erillisessä koneessa (VPS-esiintymä, joka toimii DigitalOcean:ssä) käyttämällä GPT-5.6-sol:tä korkeimmassa päättelytilassa. Jotkut muut käyttämämme agentit käyttävät muita agenttivaljaita ja -malleja, mutta tähän haluan keskittyä tässä artikkelissa.
Huomasimme, että useimmat yritykset eivät käytä tämän tyyppistä autonomista agenttia kriittisten virtojen ajamiseen yrityksessään, mikä todella hidastaa niitä. Itse asiassa monet heistä luottavat pienempiin, henkilökohtaisempiin agentteihin: koodausagenteihin, kuten Codex/ClaudeCode, tai avustajiin, kuten Work/Cowork/Copilot. Nämä suorittavat tehtäviä paikallisilla koneilla ja laitteilla, ja niiden ensisijainen puute on tiedon puute. Tämä johti kokonaan uuteen ”toisten aivojen” järjestelmien alaan, joka pohjimmiltaan yrittää luoda tietokaavion, joka jaetaan näiden hajautettujen agenttien kesken. Näin työskentelevät yritykset ilmoittavat usein, että heillä on agentteja kymmenissä, satoissa ja joissakin ääritapauksissa tuhansissa. Tämä tarkoittaa periaatteessa sitä, että jokaisella työntekijällä on yksi tai useampi rajoitettu agentit, jotka suorittavat tehtäviä heille.
Se, että agentit joutuivat aikaisessa vaiheessa alttiiksi tosielämän datalle, käyttäjien valituksille ja koodillemme, teki heistä dramaattisesti ketterämpiä ja älykkäämpiä kuin yksikään heidän rinnallaan toimiva henkilökohtainen agentti.
Tajusimme juuri, että älykkäimmistä agenteistamme on tulossa yrityksen superäly.
Selvyyden vuoksi: en väitä järkeä, AGI tai mitään sen läheistä. Ehdotan, että ne ovat aivan uusi kokonaisuus yrityksen organisaatiokaaviossa.
Mikä on yrityksen superäly?
Kun yksi agentti alkaa erottua joukosta, niin kauan kuin se on keskittynyt, siitä voi tulla superälykäs kokonaisuus. Miten määrittelemme sen?
Sanoisin, että useimmissa tapauksissa agenteilla on tällä hetkellä etupäässä kärsivällisyys ja sinnikkyys, ei älykkyys ihmisiin nähden. Kuitenkin, kun mallit paranivat (GPT 5.6 sol ja Opus 5 ovat todella hyviä!), olemme alkaneet nähdä jotain uutta, jotain, joka ylittää sen, mitä voimme tehdä – ei vain nopeudessa, vaan siinä, mitä ihmiset eivät voi tehdä.
Se alkoi meille, kun annoimme agentillemme runsaasti dataa (Mixpanel) ja liiketoimintaanalytiikkaa ja pääsyä tietoihin (virheet Sentry:n kautta, taloustiedot Baremetrics:ssä, AI-jäljet LangSmithin kautta). Seuraavaksi paljastimme sen käyttäjävirheille (Sentry-virheet) ja käyttäjien valitusraporteille. Lopuksi annoimme sille pääsyn koodausagentteihin ja ensisijaisiin repoihin GitHubissa. Sillä ei ole ulkopuolista pääsyä sähköpostin tai minkään käyttäjien vuorovaikutuksen kautta, mutta katsomalla, kuinka toimimme näissä aiheissa, se alkoi ymmärtää asioita. Näiden vuorovaikutusten avulla se tarkkailee nyt, mikä on esto, mitä kriittistä ajattelua on, kuinka liiketoimintamme toimii ja mitä ovat SOP (Standard Operating Procedures). Se tekee tämän yrityksen ja erehdyksen kautta, ja se näyttää saavan älykkyyttä säännöllisesti.
Siinä vaiheessa aloimme kysyä siltä mielenkiintoisia kysymyksiä. Aluksi kaikki vaati kaksinkertaista tarkistusta ja kritiikkiä, kun asioita ei selitetty kunnolla tai johtopäätökset kuulostivat hämäriltä. Se tekee tätä edelleen ajoittain, esimerkiksi kysyin siltä regressioista ja se antoi minulle meluisia virhetietoja, mutta se on oppimismahdollisuus: opetin sille määritelmäni regressioista ja nyt se ”saa sen”.
Kun käyttäjät valittavat tai virheet lisääntyvät, luomme ennakoivasti korjauksia. Tämä tarkoittaa, että joka aamu insinööriemme ei tarvitse tarkistaa regressioita, heidän on vain päätettävä, onko PR hyvä vai ei. Aluksi nämä olivat kertakäyttöisiä PR:itä, jotka eivät vastanneet koodauksen laatustandardejamme, joten insinöörit kertoivat sille, mikä oli vialla, tai vain kehittivät ongelman itse. Kun luottamus kasvoi, monet näistä korjauksista alkoivat sulautua koodikantaan automaattisesti. Agentti arvioi myös kuinka monimutkainen PR on ja kuinka varma agentti on sen yhdistämisessä. Emme ole siinä vaiheessa, että nämä PR:t yhdistetään automaattisesti, mutta näen polun sinne, oletan, että olemme siellä kuukauden tai kahden kuluttua.
Mutta se ei todellakaan tee agentista erittäin älykästä. Mitä tekee siitä, että nyt kun yrityksen insinöörit ja johto luottavat agenttiin, he alkavat delegoida sille työtä ja kysellä siitä todella mielenkiintoisia kysymyksiä. Se tekee tutkimuksen heidän puolestaan, ei kuten Google-hauissa, vaan pitäen mielessä yrityksen edistyneen tietämyksen, mikä antaa sille erityistä etua. Sama koskee sitä, että sille annetaan tietoa useammasta yrityksen osasta. OpenClaw ja HermesAgent hajosivat historiallisesti jossain vaiheessa, kun niiden historiallinen konteksti ylitti niiden kyvyn käsitellä tietoja. Tämän tyyppinen hajoaminen tapahtuisi ja seurauksena oli älykkyyden, muistin ja työn laadun jyrkkä lasku. Kokemuksemme Hermes Agent:stä on nyt aivan erilainen: keskustelumuisti on nyt 3 Gt ja kasvaa eksponentiaalisesti, kun taas sen älykkyys paranee selvästi ajan myötä.
Se ei tarkoita sitä, että se olisi täydellinen, siinä on regressioita ja sinun on joskus muistutettava sitä käyttäytymään tietyllä tavalla tai tunnistamaan, miksi se ei toimi odotetulla tavalla tietyssä kontekstissa tai vastaa oikein toiselle agentille, joka pyytää siltä tietoja tai toimia. Mutta perille ollaan tulossa.
Haarojen suojauksen odottamaton sivuvaikutus toi meille uuden edistyksen. Haarojen suojauksen ideana on, että vähintään kaksi ihmistä näkee PR:n ennen kuin se tulee tuotantoon, mikä vähentää huonon (tai jopa ilkeän) koodin mahdollisuuksia päästä järjestelmään. Tämä on yhä vaikeampaa tehdä kunnolla uusilla koodaavilla aineilla. Nopeuden kasvaessa uusien PR:iden määrää ja koodin määrää on lähes mahdotonta tarkistaa perusteellisesti käsin. Meillä on useita agentteja eri toimittajilta, jotka tarkastelevat asiakaspalvelijoita virheiden, tietoturvaongelmien ja arkkitehtonisten ongelmien varalta. Haarojen suojaus kuitenkin säilyy, joten annoin superälykkään agenttimme olla PR:n lopullinen hyväksyjä.
Odotimme puoliksi, että tulokset olisivat arkipäiväisiä. Loppujen lopuksi nämä PR:t läpäisivät paikallisten koodausagenttien arvostelut, testit, tietoturvatarkastukset, ulkoiset GitHubCopilot- ja CodeRabbit-arvostelut ja hyväksyttiin kokonaan. Mutta agenttimme teki silti reikiä noihin PR:iin. Se löysi todella mielenkiintoisia reunatapauksia, joita emme ottaneet huomioon, tietoturvaa, ohjelmistojen laatua ja arkkitehtuurivirheitä, joita emme huomioineet. Se käyttää samoja malleja kuin kaikki muutkin arvioijat, miksi se keksii asioita, joita muut eivät olleet?
Se riippuu tiedosta ja kokemuksesta. Hermes Agent-valjaat yhdistettynä agentin keräämään tietoon luovat uudenlaisen superälykkään agentin, jota emme ole ennen nähneet. Joten tutkimme tätä tarkemmin ja teimme agenttien arvioinnista pakollisia, ei vain järjestelmän parissa työskenteleville ihmisille, vaan se toimii nyt referenssinä muille, vähemmän älykkäille agenteille!
Tällä agentilla on nyt kyky antaa meille kriittistä ajattelua, jonka näimme aiemmin vain ihmisissä, mutta todellisen asiakasdatan, palautteen, koodimme ja tuotteen syvällisen ymmärryksen tukemana.
Jos laajennamme tätä ja annamme sille enemmän dataa syötettäväksi, skaalaamme sen laitteistoa ja muistia, näemme suorituskyvyn eksponentiaalisen kasvun. Luulen, että mallit pitävät sitä edelleen. Kun pääsemme tämän pelin seuraavaan vaiheeseen, ehkä GPT-6:n kautta, tulokset ovat dramaattisesti mielenkiintoisempia. Kun keräämme enemmän tietoa, anna agenteille enemmän tehtäviä ja luota siihen enemmän.
Miten tämä eroaa Karpathyn Wiki-pohjaisista toisista aivoista?
Eroaa muista lähestymistavoista on se, että sen sijaan, että käsiteltäisiin jaettua tietoa, superagenttitieto tallennetaan paikallisesti. Voimme pyytää sitä säilyttämään oman muistinsa ja maailmanymmärryksensä repossa, jolloin voimme kopioida sen ja seurata sitä, mutta lopulta se on ei Tietojen ja taitojen jakamisesta ja yhteistyöstä. Se on ainutlaatuinen tietokanta, joka yhdessä työkalujen ja pääsyn maailmaan antaa sen vastata kysymyksiisi suoraan. Et pyydä agenttiasi selvittämään sitä käyttämällä jaettua tietoa, vaan joko sinä tai agenttisi esität kysymyksesi Superälykkäälle agentille. Yllättäen tämä toimii meillä hyvin juuri nyt siinä määrin, että laajennamme jatkuvasti agentin pääsyä ja kattavuutta, emmekä näe vielä huonontunutta tietoa tai älyä.
Huomaa: emme altista agenttia arkaluontoisille tiedoille tai toiminnoille. Sillä ei ole suoraa pääsyä pankki-, veloitus- tai laskutusjärjestelmiimme. Se on myös erillään maailmasta, eikä sillä ole pääsyä sähköpostiin tai ulkopuolisiin kanaviin. Kun saamme kokemusta ja luottamusta, en usko, että olemme kovin kaukana myös näiden rajoitusten poistamisesta.

Figma
Adobe XD
Blog

