Nikto vám nemôže povedať, ktorý agentický ERP je najlepší, bez toho, aby poznal vaše podnikanie, a akákoľvek stránka, ktorá ich hodnotí, predáva umiestnenie alebo háda. Čo sa dá urobiť čestne, je poskytnúť vám testy, ktoré oddeľujú agentický systém od toho, ktorý pridal chatovaciu funkciu, a dôkazy, ktoré môžete požiadať od každého dodávateľa. Existuje päť: otvorený protokol, ktorý umožňuje vášmu vlastnému agentovi pripojiť sa z vonku; oprávnenia vynucované na každého používateľa pri každom hovore; rozpočet na výdavky, ktorý agent nemôže prekročiť; auditný záznam, ktorý zaznamenáva prácu agenta rovnako podrobne ako prácu osoby; a trh, ktorý ukazuje, že iní vývojári môžu rozšíriť systém prostredníctvom rovnakých nástrojov.
Otestujte všetkých päť produktov na vašom zozname v prostredí, ktoré máte, a ohodnoťte ich písomne. Produkt, ktorý prejde všetkými piatimi a pokrýva moduly, ktoré skutočne potrebujete, je pre vás najlepší. To je záver, ktorý môžete obhájiť pred správou, čo rebríček nie je.
Prečo tu nie je hodnotenie
Predstavte si zoznam. Štyria dodávatelia, štyri návrhy a slovo agentic na každom obale. Jeden je zavedený balík s asistentom pridaným minulý rok. Jeden je novší produkt postavený okolo svojho vlastného agenta. Jeden je platforma, ktorá umožňuje akémukoľvek agentovi pripojiť sa cez otvorený protokol. Jeden je nástroj na pracovný tok s jazykovým modelom uprostred. Všetky štyri sa dobre predvádzajú. Dva z nich stále očakávajú osobu pri obrazovke pre čokoľvek, čo prekročí hranicu modulu, a z návrhov nezistíte, ktoré dva to sú.
Zoznam s hodnotením vám s tým nepomôže, a to z dôvodu, ktorý nemá nič spoločné s kvalitou produktov. Agentic je vlastnosť architektúry a to, či je daná architektúra pre vás správna, závisí od toho, ktoré moduly používate, ktorého agenta už váš tím používa, aké sú vaše schvaľovacie prahy a koľko potrebujete vidieť v protokole. To sú vaše fakty, nie fakty recenzenta. To, čo sa prenáša medzi podnikmi, je súbor testov, takže táto stránka vám poskytuje testy a žiada vás, aby ste vykonali hodnotenie.
Test 1: otvorený protokol, váš agent z vonku
Prvý test je, či môže agent, ktorého dodávateľ nevytvoril, ovládať systém. Otvorený štandard pre toto je Model Context Protocol, ktorým hovoria hlavní klienti agentov: Claude pridáva vzdialený server MCP ako vlastný konektor s prihlásením cez OAuth; ChatGPT robí to isté v režime pre vývojárov s plnou podporou čítania a zápisu; kódovacie agenti a interní agenti postavení na SDK dodávateľa sa pripájajú rovnakým spôsobom. Produkt, ktorý hovorí MCP, môže byť ovládaný ktorýmkoľvek z nich. Produkt, ktorý funguje iba so svojím vlastným asistentom, nemôže byť ovládaný nikým iným, a toto rozhodnutie bolo urobené za vás.
Dôkaz, o ktorý treba požiadať, je odpoveď servera na požiadavku tools/list, ktorá je podľa protokolu strojovo čitateľným zoznamom všetkého, čo agent môže robiť. Malo by to vyzerať nejako takto, opakované pre každú akciu v systéme.
{
"tools": [
{
"name": "contacts.search",
"description": "Find contacts by name, email or company.",
"inputSchema": { "type": "object", "properties": { "query": { "type": "string" } }, "required": ["query"] }
},
{
"name": "invoices.create",
"description": "Create a draft invoice from billable lines. Fails if the caller cannot raise invoices.",
"inputSchema": { "type": "object", "properties": { "customer_id": { "type": "string" }, "lines": { "type": "array" } }, "required": ["customer_id", "lines"] }
},
{
"name": "purchase_orders.approve",
"description": "Approve a purchase order within the caller's approval limit.",
"inputSchema": { "type": "object", "properties": { "purchase_order_id": { "type": "string" } }, "required": ["purchase_order_id"] }
}
]
}Ilustratívna odpoveď nástrojov/zoznamu v tvare, ktorý definuje špecifikácia MCP. Názvy a pokrytie sa budú líšiť podľa produktu; dôležité je, že zoznam existuje, je typovaný a je dostatočne dlhý na pokrytie modulov, ktoré používate.
Tri veci, ktoré je potrebné skontrolovať v zozname. Je dlhý, pretože ERP má stovky akcií a zoznam dvadsiatich znamená, že asistent dosiahne dvadsať funkcií. Je typovaný, s JSON schémou pre každý vstup, pretože to umožňuje serveru overiť volania namiesto interpretácie prózy. A mení sa, keď sa prihlási obmedzenejší používateľ, čo je most k druhému testu.
Test 2: práva na používateľa pri každom volaní
An agent that can do more than the person it represents is a liability, not a feature. The second test is whether permissions are enforced per user and per call, not per product or per session. The protocol allows a server to vary the tool list by the authorisation presented and requires servers to implement proper access controls, but it cannot enforce either on the vendor's behalf. The good implementations filter the list before the agent sees it and then check again when each tool runs, because a filtered list is a courtesy and an execution-time check is a control.
Dôkazom je živé odmietnutie. Prihláste sa ako používateľ, ktorý nemôže schvaľovať objednávky, požiadajte svojho agenta, aby jednu schválil, a sledujte, čo sa stane. Správna odpoveď je jednoduché odmietnutie v momente hovoru, zaznamenané, pričom zvyšok požiadavky sa stále dokončuje. Nesprávne odpovede sú schválenie, ktoré prejde, chyba, ktorá odhalí, čo by nástroj urobil, alebo relácia, ktorá sa otvorí, pretože kontrola bola len na obrazovke.
Test 3: transparentnosť rozpočtu a nákladov
Agent, ktorý uvažuje na základe modelov dodávateľa, spotrebuje niečo zakaždým, keď beží, a tretí test je, či môžete obmedziť túto výdavkovú položku a vidieť, kam išla. Konkrétny mechanizmus je menej dôležitý ako dve vlastnosti: limit nastavený na integráciu alebo na kľúč, ktorý agent nemôže prekročiť, a záznam o nákladoch na každú akciu. Produkt, ktorý vám môže povedať iba mesačný súčet až po skutočnosti, nevytvoril meradlo, a to zistíte, keď sa spustí nekontrolovaný cyklus alebo nadšený nový používateľ dostane účet.
Existuje druhá otázka nákladov, ktorú stránky s hodnotením úplne preskakujú. Ak produkt umožňuje priniesť si vlastného agenta, potom keď tento agent vykonáva uvažovanie, dodávateľ nemusí vykonávať žiadnu AI vo vašom mene a za to si nemusí účtovať nič. Pre tím, ktorý už platí za Claude alebo ChatGPT, sa náklady na agenta stávajú položkou, ktorú ovládate, namiesto položky, ktorú nastavuje dodávateľ. Opýtajte sa každého dodávateľa, čo si účtujú, keď váš vlastný agent vykonáva uvažovanie, a zapíšte si odpoveď.
Test 4: audit, ktorý sa číta ako denník osoby
Keď agent vykonáva prácu, záznam sa stáva primárnym spôsobom, akým manažér hodnotí túto prácu, takže štvrtý test je, či auditná stopa zaznamenáva akcie agenta rovnako úplne ako akcie osoby. Minimálne by malo byť zaznamenané, kto požiadal, ktorý agent konal v ich mene, ktoré nástroje bežali, s akými vstupmi, s akým výsledkom a kedy. Vlastné usmernenia protokolu sú, že klienti by mali zaznamenávať používanie nástrojov na audit; server by mal robiť to isté z jeho strany, pretože to je server, ktorý vie, čo sa skutočne zmenilo.
Dôkazom je samotný záznam, po požiadavke na demo. Otvorte ho a skontrolujte štyri veci: priradenie osobe, nie generickému používateľovi integrácie; sekvencia volania nástrojov, nie iba záznamy, ktoré boli nakoniec zmenené; vstupy a výsledky, aby sa nesprávna akcia mohla sledovať k nesprávnemu vstupu; a odmietnutia, pretože model oprávnení, ktorý nezaznamenáva svoje odmietnutia, nemôže byť doladený.
Test 5: trh a čo vám hovorí
Piaty test je nepriamy, ale odhaľujúci. Ak má platforma trh aplikácií vytvorených ľuďmi inými ako dodávateľ, a tieto aplikácie sú prevádzkované agentmi prostredníctvom rovnakého rozhrania nástroja ako základné moduly, potom je rozhranie nástroja skutočné, zdokumentované a dostatočne stabilné na to, aby na ňom mohli stavať externí vývojári. Trh je vlastná architektúra dodávateľa testovaná cudzími osobami každý deň. Taktiež odpovedá na praktickú otázku, čo sa stane, keď potrebujete funkciu, ktorú základný produkt nemá: či čakáte na plán, platíte za prácu na mieru, alebo inštalujete niečo, čo už existuje.
Dôkazom je publikovaná aplikácia od tretej strany, nainštalovaná do vášho skúšobného pracovného priestoru, objavujúca sa v zozname nástrojov agenta pri ďalšej požiadavke. Ak trh existuje, ale aplikácie sú všetky od dodávateľa, alebo ak inštalácia jednej nezmení, čo agent môže robiť, test je iba čiastočne splnený.
Hodnotiaca karta
Vezmite si toto na každé demo a vyplňte to v deň prezentácie. Ohodnoťte každý test ako splnený, čiastočne splnený alebo nesplnený a trvajte na tom, aby ste videli dôkazy, namiesto toho, aby ste o nich počuli. Produkt, ktorý nesplní prvý test, je produkt s asistentom, nech už obal hovorí čokoľvek, a ostatné štyri testy sa stávajú akademickými.
| Test | Čo prechádza | Dôkazy, o ktoré sa treba pýtať |
|---|---|---|
| 1. Otvorený protokol | Váš vlastný agent sa pripája zvonka cez MCP pomocou OAuth | Odpoveď na zoznam nástrojov; živé pripojenie z Claude alebo ChatGPT |
| 2. Oprávnenia na používateľa | Nástroje filtrované podľa úlohy a znovu kontrolované pri každom volaní; zlyháva uzavretím | Agent obmedzeného používateľa bol pri volaní odmietnutý, ostatné dokončili |
| 3. Rozpočet | Strop na integráciu, ktorý agent nemôže prekročiť; náklady viditeľné na akciu | Nastavenie stropu; záznam o používaní na akciu; cena, keď váš vlastný agent uvažuje |
| 4. Audit | Kto sa pýtal, ktorý agent, ktoré nástroje, vstupy, výsledky, odmietnutia | Záznam o žiadosti o demo, otvorený pred vami |
| 5. Trh | Aplikácie tretích strán volateľné agentom cez rovnaké rozhranie | Jedna nainštalovaná aplikácia sa zobrazuje v zozname nástrojov agenta |
Hodnotenie písania v deň. Najlepší agentický ERP vo vašom výbere je ten, ktorý prejde všetkými piatimi a pokrýva moduly, ktoré používate.
Sois je jedna implementácia, proti ktorej môžete tieto testy vykonať, a keďže ju vytvárame, môžeme povedať, ako odpovedá. Pracovný priestor je server MCP; akýkoľvek kompatibilný klient sa pripojí pridaním adresy pracovného priestoru a prihlásením sa raz cez OAuth, bez potreby vkladať token. Nástroje sú filtrované podľa úlohy používateľa predtým, ako sú ponúknuté, a kontrolujú sa znova, keď sa spustia, a prístup sa zamieta. Výdavky môžu byť obmedzené na integráciu, každá akcia je zaznamenaná a keď váš vlastný agent vykonáva uvažovanie, platforma nevykonáva žiadnu AI vo vašom mene a nič za to neúčtuje. Vývojári vytvárajú aplikácie so svojím vlastným agentom, overujú ich lokálne zadarmo a publikujú na trhu, kde ich môže volať každý pripojený agent. Vykonajte rovnakých päť testov proti nemu ako proti ostatným; na to sú určené.
Otázky, ktoré sa ľudia pýtajú.
Existuje najlepší agentický ERP pre malé podniky?
Nie ako hodnotenie. Ten správny závisí od toho, ktoré moduly používate, ktorého agenta váš tím používa a koľko kontroly potrebujete. Vykonajte päť testov proti produktom, ktoré pokrývajú vaše moduly, v skúšobnom pracovnom priestore, a odpoveďou je ten, ktorý prejde všetkými.
Musí ERP podporovať MCP, aby bol agentický?
Musí vystaviť svoje akcie ako nástroje, ktoré môže volať vonkajší agent, a MCP je otvorený štandard, ktorý používajú hlavní klienti. Produkt, ktorý funguje iba so svojím vlastným asistentom, môže byť užitočný, ale rozhodol, ktorého agenta používate a aký má dosah.
Aký je najdôležitejší test?
Prvý. Ak sa váš vlastný agent nemôže pripojiť zvonka cez otvorený protokol, produkt je asistentom vo vnútri obrazovky a zostávajúce testy popisujú kontroly, ktoré nepotrebuje. Ak prejde, test oprávnenia je ten, ktorý rozhoduje, či mu môžete dôverovať pri zápisoch.
- špecifikácia Model Context Protocol: nástroje nástroje/zoznam a nástroje/volanie, zoznamy nástrojov závislé od autorizácie a bezpečnostné požiadavky na serveroch a klientoch vrátane audítorského logovania
- Anthropic: začnite s vlastnými konektormi pomocou vzdialeného MCP ako sa Claude pripája k vzdialenému serveru MCP pomocou OAuth a schválenia na úrovni nástroja
- OpenAI: vývojársky režim ChatGPT plná podpora klientov MCP v ChatGPT, vrátane akcií písania s potvrdením
- Dokumentácia Sois: server pracovného priestoru MCP ako jedna implementácia spĺňa päť testov: OAuth, nástroje filtrované podľa rolí, vykonávanie s uzavretím pri zlyhaní, rozpočtové limity
Tento článok sa prehodnocuje, keď sa zmenia produkty, ktoré popisuje. Ďalšie naplánované prehodnotenie: 4. decembra 2026.
