Nobody can tell you the best agentic ERP without knowing your business, and any page that ranks them is selling placement or guessing. What can be done honestly is to give you the tests that separate an agentic system from one that has added a chat box, and the evidence to ask each vendor for. There are five: an open protocol that lets your own agent connect from outside; permissions enforced per user on every call; a spend budget the agent cannot exceed; an audit log that records the agent's work as fully as a person's; and a marketplace that shows other builders can extend the system through the same tools.
Izmēģiniet visus piecus katram produktam jūsu izvēlētajā sarakstā, savā vidē, un novērtējiet tos rakstiski. Produkts, kas iztur visus piecus un aptver moduļus, kas jums patiešām nepieciešami, ir vislabākais jums. Tas ir secinājums, ko varat aizstāvēt padomē, kas nav rangs.
Kāpēc šeit nav rangojuma
Iedomājieties īso sarakstu. Četri piegādātāji, četri piedāvājumi un vārds agentic uz katra vāka. Viens ir izveidota komplekta ar palīgu, kas pievienots pagājušajā gadā. Viens ir jaunāks produkts, kas veidots ap savu aģentu. Viens ir platforma, kas ļauj jebkuram aģentam savienoties caur atvērtu protokolu. Viens ir darba plūsmas rīks ar valodas modeli vidū. Visi četri demonstrē labi. Divi no tiem joprojām gaidīs cilvēku pie ekrāna, lai veiktu jebko, kas pārsniedz moduļa robežu, un jūs neuzzināsiet, kuri divi no piedāvājumiem.
Reitinga saraksts tam nevar palīdzēt, jo iemesls nav saistīts ar produktu kvalitāti. Aģentiskums ir arhitektūras īpašība, un vai konkrētā arhitektūra ir piemērota jums, ir atkarīgs no tā, kurus moduļus jūs izmantojat, kuru aģentu jūsu komanda jau izmanto, kādi ir jūsu apstiprinājuma sliekšņi un cik daudz jums ir nepieciešams redzēt žurnālā. Tie ir jūsu fakti, nevis recenzenta. Tas, kas ceļo starp uzņēmumiem, ir testu kopums, tāpēc šī lapa sniedz jums testus un lūdz jūs veikt reitingu.
Tests 1: atvērtais protokols, jūsu aģents no ārpuses
Pirmais tests ir, vai aģents, ko piegādātājs nav izstrādājis, var darbināt sistēmu. Atvērtais standarts tam ir Model Context Protocol, ko izmanto galvenie aģentu klienti: Claude pievieno attālu MCP serveri kā pielāgotu savienotāju ar OAuth pieteikšanos; ChatGPT dara to pašu izstrādātāja režīmā ar pilnu lasīšanas un rakstīšanas atbalstu; kodēšanas aģenti un iekšējie aģenti, kas izstrādāti, izmantojot piegādātāja SDK, savienojas tāpat. Produkts, kas runā MCP, var darbināt jebkurš no viņiem. Produkts, kas darbojas tikai ar savu asistentu, nevar darbināt neviens cits, un šis lēmums ir pieņemts jūsu vietā.
Pierādījums, ko jāpieprasa, ir servera atbilde uz rīku/saraksta pieprasījumu, kas saskaņā ar protokolu ir mašīnas lasāms saraksts ar visu, ko aģents var darīt. Tam vajadzētu izskatīties aptuveni šādi, atkārtoti katrai darbībai sistēmā.
{
"tools": [
{
"name": "contacts.search",
"description": "Find contacts by name, email or company.",
"inputSchema": { "type": "object", "properties": { "query": { "type": "string" } }, "required": ["query"] }
},
{
"name": "invoices.create",
"description": "Create a draft invoice from billable lines. Fails if the caller cannot raise invoices.",
"inputSchema": { "type": "object", "properties": { "customer_id": { "type": "string" }, "lines": { "type": "array" } }, "required": ["customer_id", "lines"] }
},
{
"name": "purchase_orders.approve",
"description": "Approve a purchase order within the caller's approval limit.",
"inputSchema": { "type": "object", "properties": { "purchase_order_id": { "type": "string" } }, "required": ["purchase_order_id"] }
}
]
}Ilustratīvs rīku/saraksta atbildes veids, kā to definē MCP specifikācija. Nosaukumi un segums atšķirsies atkarībā no produkta; svarīgi ir, lai saraksts pastāvētu, būtu tipizēts un pietiekami garš, lai segtu moduļus, kurus izmantojat.
Trīs lietas, ko pārbaudīt sarakstā. Tas ir garš, jo ERP ir simtiem darbību, un divdesmit elementu saraksts nozīmē, ka asistents sasniedz divdesmit funkcijas. Tas ir tipizēts, ar JSON shēmu katram ievadam, jo tas ļauj serverim validēt izsaukumus, nevis interpretēt prozu. Un tas mainās, kad piesakās ierobežotāks lietotājs, kas ir tilts uz otro testu.
Tests 2: atļaujas katram lietotājam katrā izsaukumā
An agent that can do more than the person it represents is a liability, not a feature. The second test is whether permissions are enforced per user and per call, not per product or per session. The protocol allows a server to vary the tool list by the authorisation presented and requires servers to implement proper access controls, but it cannot enforce either on the vendor's behalf. The good implementations filter the list before the agent sees it and then check again when each tool runs, because a filtered list is a courtesy and an execution-time check is a control.
Pierādījums ir tieša atteikšana. Piesakieties kā lietotājs, kurš nevar apstiprināt pirkuma pasūtījumus, lūdziet viņu aģentam apstiprināt vienu un skatieties, kas notiek. Pareizā atbilde ir vienkārša atteikšana zvana brīdī, reģistrēta, kamēr pārējā pieprasījuma izpilde turpinās. Nepareizās atbildes ir apstiprinājums, kas iziet cauri, kļūda, kas atklāj, ko rīks būtu darījis, vai sesija, kas neizdodas, jo pārbaude bija tikai uz ekrāna.
Tests 3: budžeta un izmaksu caurredzamība
Aģents, kas pamatojas uz piegādātāja modeļiem, patērē kaut ko katru reizi, kad tas darbojas, un trešais tests ir, vai jūs varat ierobežot šo izdevumu un redzēt, kur tas aizgāja. Konkrētais mehānisms ir mazāk svarīgs nekā divas īpašības: limits, kas noteikts katrai integrācijai vai katrai atslēgai, ko aģents nevar pārsniegt, un katras darbības ieraksts par to, cik daudz katra izpilde izmaksāja. Produkts, kas var tikai pateikt jums mēneša kopējo summu pēc fakta, nav izveidojis skaitītāju, un jūs to uzzināsiet, kad nevaldāma cilpa vai jauns lietotājs saņem rēķinu.
Ir otra izmaksu jautājuma daļa, ko rangēšanas lapas pilnībā izlaiž. Ja produkts ļauj jums izmantot savu aģentu, tad, kad šis aģents veic pamatošanu, piegādātājs var vispār neveikt nekādu mākslīgo intelektu jūsu vārdā un par to neko neiekasēt. Komandai, kas jau maksā par Claude vai ChatGPT, tas pārvērš aģenta izmaksas par rindu, kuru jūs kontrolējat, nevis rindu, ko nosaka piegādātājs. Uzdodiet katram piegādātājam, ko viņi iekasē, kad jūsu aģents veic domāšanu, un pierakstiet atbildi.
Tests 4: audits, kas izskatās kā cilvēka žurnāls
Kad aģents veic darbu, žurnāls kļūst par galveno veidu, kā vadītājs to pārskata, tāpēc ceturtais tests ir, vai revīzijas pēdas ieraksta aģenta darbības tikpat pilnīgi kā cilvēka. Minimālais ir, kurš jautāja, kurš aģents rīkojās viņu vārdā, kuri rīki tika izmantoti, ar kādiem ievadiem, ar kādu rezultātu un kad. Protokola paša vadlīnijas nosaka, ka klientiem jāreģistrē rīku izmantošana revīzijai; serverim jāveic tas pats no savas puses, jo tieši serveris zina, kas patiesībā ir mainījies.
Pierādījums ir pats žurnāls pēc demonstrācijas pieprasījuma. Atveriet to un pārbaudiet četras lietas: atribūcija personai, nevis vispārējam integrācijas lietotājam; rīku izsaukumu secība, ne tikai ieraksti, kas beidzās ar izmaiņām; ievadi un rezultāti, lai nepareiza darbība varētu tikt izsekošana nepareizai ievadei; un atteikumi, jo atļauju modelis, kas nereģistrē savus atteikumus, nevar tikt pielāgots.
Tests 5: tirgus, un ko tas jums stāsta
Piektais tests ir netiešs, bet atklājošs. Ja platformai ir lietotņu tirgus, ko izveidojuši cilvēki, kas nav piegādātājs, un šīs lietotnes darbojas caur aģentiem, izmantojot to pašu rīku saskarni kā pamatmoduļi, tad rīku saskarne ir reāla, dokumentēta un pietiekami stabila, lai ārējiem cilvēkiem uz tās būvētu. Tirgus ir piegādātāja paša arhitektūra, ko katru dienu testē svešinieki. Tas arī atbild uz praktisko jautājumu par to, kas notiek, kad jums nepieciešama spēja, kādas pamatprodukts trūkst: vai jūs gaidāt ceļa karti, maksājat par pielāgotu darbu vai instalējat kaut ko, kas jau pastāv.
Pierādījums ir publicēta lietotne no trešās puses, instalēta jūsu izmēģinājuma darba telpā, parādoties aģenta rīku sarakstā nākamajā pieprasījumā. Ja tirgus pastāv, bet lietotnes ir tikai piegādātāja pašas, vai ja viena instalēšana nemaina to, ko aģents var darīt, tests ir izpildīts tikai daļēji.
Rezultātu karte
Ņemiet to līdzi uz katru demonstrāciju un aizpildiet to dienā. Novērtējiet katru testu kā izpildītu, daļēji izpildītu vai neizpildītu, un uzstājiet uz pierādījumu redzēšanu, nevis dzirdēšanu par to. Produkts, kas neiztur pirmo testu, ir produkts ar palīgu, neatkarīgi no tā, ko saka vāks, un pārējie četri testi kļūst par akadēmiskiem.
| Tests | Kas tiek izpildīts | Pierādījums, ko lūgt |
|---|---|---|
| 1. Atvērt protokolu | Jūsu aģents savienojas no ārpuses, izmantojot MCP ar OAuth | Rīku/saraksta atbilde; tieša savienojums no Claude vai ChatGPT |
| 2. Atļaujas katram lietotājam | Rīki filtrēti pēc lomas un pārbaudīti katrā izsaukumā; neveiksmju gadījumā slēgti | Ierobežota lietotāja aģents tika noraidīts izsaukumā, pārējie pabeidza |
| 3. Budžets | Maksimālā summa katrai integrācijai, ko aģents nevar pārsniegt; izmaksas redzamas katrā darbībā | Maksimālās summas iestatījums; katras darbības lietošanas ieraksts; cena, kad jūsu aģents veic secinājumus |
| 4. Audits | Kas jautāja, kurš aģents, kuri rīki, ievadi, rezultāti, noraidījumi | Žurnāla ieraksts par demonstrācijas pieprasījumu, atvērts jūsu priekšā |
| 5. Tirgus | Trešo pušu lietotnes, ko aģents var izsaukt caur to pašu saskarni | Vienai instalētai lietotnei parādīties aģenta rīku sarakstā |
Rakstiski novērtējiet dienā. Labākais aģentiskais ERP jūsu sarakstā ir tas, kas izpilda visus piecus un aptver moduļus, ko izmantojat.
Sois ir viena no ieviešanām, pret kuru varat veikt šos testus, un, tā kā mēs to izstrādājam, mēs varam teikt, kā tas atbild. Darba vide ir MCP serveris; jebkurš saderīgs klients pieslēdzas, pievienojot darba vides adresi un reģistrējoties vienu reizi caur OAuth, bez nepieciešamības ievadīt token. Rīki tiek filtrēti pēc lietotāja lomas pirms to piedāvāšanas un vēlreiz pārbaudīti, kad tie tiek izmantoti, un piekļuve tiek slēgta, ja tā neizdodas. Izdevumi var tikt ierobežoti katrai integrācijai, katra darbība tiek reģistrēta, un, kad jūsu paša aģents veic loģiku, platforma neveic nekādu AI jūsu vārdā un par to neko neiekasē. Izstrādātāji izstrādā lietotnes ar savu aģentu, vietēji validē bez maksas un publicē tirgū, kur katrs savienotais aģents var tās izsaukt. Veiciet tos pašus piecus testus pret to kā pret visiem citiem; tie ir paredzēti tieši tam.
Cilvēki uzdod jautājumus
Vai ir labākais aģentiskais ERP mazajiem uzņēmumiem?
Nevis kā rangs. Pareizais atkarīgs no tā, kuri moduļi jums ir, kuru aģentu izmanto jūsu komanda un cik daudz kontroles jums nepieciešams. Veiciet piecus testus pret produktiem, kas aptver jūsu moduļus, izmēģinājuma darba vidē, un atbilde ir tā, kas izpilda visus.
Vai ERP ir jāatbalsta MCP, lai būtu aģentisks?
Tam ir jāizpauž savas darbības kā rīkus, ko var izsaukt ārējs aģents, un MCP ir atvērtais standarts, ko izmanto galvenie klienti. Produkts, kas darbojas tikai ar savu palīgu, var būt noderīgs, bet tas ir noteicis, kuru aģentu jūs izmantojat un cik tālu tas sasniedz.
Kāds ir vissvarīgākais tests?
Pirmais. Ja jūsu paša aģents nevar pieslēgties no ārpuses caur atvērtu protokolu, produkts ir palīgs ekrānā, un atlikušajiem testiem ir aprakstīti kontroles mehānismi, kas tam nav nepieciešami. Ja tas izpilda, atļauju tests ir tas, kas nosaka, vai varat tam uzticēties rakstīšanai.
- Model Context Protocol specifikācija: rīki rīki/saraksts un rīki/zvans, atļauju atkarīgas rīku saraksti un drošības prasības serveriem un klientiem, tostarp audita žurnālu veidošana
- Anthropic: uzsākt darbu ar pielāgotajiem savienotājiem, izmantojot attālo MCP kā Claude pieslēdzas attālinātam MCP serverim ar OAuth un katra rīka apstiprinājumu
- OpenAI: ChatGPT izstrādātāja režīms pilna MCP klientu atbalsta ChatGPT, tostarp rakstīšanas darbības ar apstiprinājumu
- Sois dokumentācija: darba vietas MCP serveris kā viena ieviešana atbild uz pieciem testiem: OAuth, lomu filtrēti rīki, fail-closed izpilde, budžeta ierobežojumi
Šis raksts tiek pārskatīts, kad mainās tajā aprakstītie produkti. Nākamais plānotais pārskats: 2026. gada 4. decembris.
