డిప్లాయ్మెంట్ జరిగిన కొద్దిసేపటికే ఒక అలర్ట్ వస్తుంది. ఎర్రర్ రేట్లు పెరుగుతున్నాయి, ఒక సర్వీస్ సాధారణం కంటే ఎక్కువ మెమరీని వినియోగిస్తోంది, కస్టమర్ రిక్వెస్ట్లు విఫలమవడం మొదలవుతున్నాయి.
ఒక AI ఆపరేషన్స్ ఏజెంట్ డిప్లాయ్మెంట్ చరిత్రను పరిశీలిస్తుంది, ప్రభావితమైన డిపెండెన్సీలను ట్రేస్ చేస్తుంది, మునుపటి వైఫల్యాలతో ఈ ఇన్సిడెంట్ను పోలుస్తుంది. ఒక నిర్దిష్ట సర్వీస్ బహుశా దీనికి కారణమని నిర్ధారించి, దాన్ని రీస్టార్ట్ చేయాలని ప్రతిపాదిస్తుంది.
ఆ సిఫార్సు సహేతుకంగా కనిపిస్తుంది. ఇంజనీర్ కోసం వేచి ఉండటం వల్ల అంతరాయం సమయం పెరగవచ్చు. వెంటనే రీస్టార్ట్ చేయడం వల్ల సర్వీస్ పునరుద్ధరించబడవచ్చు.
ఆ ఏజెంట్ చర్య తీసుకోవాలా?
ఇది ఒక ఊహాజనిత దృశ్యం, కానీ ఆపరేషన్స్ బృందాలకు ఈ నిర్ణయం ఇప్పటికే వాస్తవ రూపం దాల్చుతోంది. ఇది కేంద్ర AgenticOps ప్రశ్నను పట్టి చూపుతుంది. సమస్య కేవలం ఒక AI వ్యవస్థ ఇన్సిడెంట్ను దర్యాప్తు చేయగలదా లేదా కమాండ్ను అమలు చేయగలదా అనేది మాత్రమే కాదు. ఆ వ్యవస్థకు ఎంత అధికారం లభించాలి, దాని అధికారం పెరగడానికి ముందు ఏ పరిస్థితులు నిజం కావాలనేదే అసలు ప్రశ్న.
నా అభిప్రాయం ప్రకారం AgenticOps ఇప్పటికే ఉపయోగకరంగా ఉంది, కానీ అనేక ముఖ్యాంశాలు సూచించే దానికంటే పరిమితమైన స్వయంప్రతిపత్తి రూపానికి మాత్రమే బహిరంగ ఆధారాలు మద్దతు ఇస్తున్నాయి. ఆధారాలను సేకరించే, ఈవెంట్లను పరస్పరం అనుసంధానించే, సంభావ్య కారణాలను దర్యాప్తు చేసే, విడుదల విధానాలను అమలు చేసే ఏజెంట్ల నుండి సంస్థలు విలువను పొందుతున్నాయి. ప్రొడక్షన్ ఇన్ఫ్రాస్ట్రక్చర్పై విస్తృతమైన, పర్యవేక్షణ లేని నియంత్రణకు సంబంధించిన ఆధారాలు ఇప్పటికీ పరిమితంగానే ఉన్నాయి.
ఇది AgenticOpsను ఒక శూన్యమైన సాంకేతిక ధోరణిగా మార్చదు. దీని అర్థం మనం దీన్ని కేవలం ఒక తెలివైన ఆటోమేషన్ టూల్గా కాకుండా, ఒక అధికార నమూనాగా మూల్యాంకనం చేయాలి.
అడాప్షన్ వాస్తవమే, కానీ అడాప్షన్ అధికారాన్ని వివరించదు
సిస్కో సెప్టెంబర్ 2026 AgenticOps నివేదిక ఒక ముఖ్యమైన మార్కెట్ సంకేతాన్ని అందిస్తుంది. ఓమ్డియా అధ్యయనం ఉత్తర అమెరికా, పశ్చిమ ఐరోపా, ఆసియా పసిఫిక్ ప్రాంతాల్లోని కనీసం 500 మంది ఉద్యోగులున్న సంస్థల నుండి 1,000 కంటే ఎక్కువ మంది IT, నెట్వర్క్ ఆపరేషన్స్ లీడర్లను సర్వే చేసింది.[1]
యాభై ఒక్క శాతం మంది ప్రొడక్షన్లో పనిచేసే ఏజెంటిక్ వ్యవస్థలు తమ వద్ద ఉన్నాయని నివేదించారు. విడిగా, 82 శాతం మంది ముందస్తు ఆమోదం లేకుండా కనీసం కొన్ని ప్రొడక్షన్ నెట్వర్క్ మార్పులను అనుమతించడానికి తాము సిద్ధంగా ఉన్నామని చెప్పారు.
కార్యాచరణ ఏజెంట్లు ప్రయోగాల దశను దాటి ముందుకు సాగుతున్నాయని ఆ గణాంకాలు చూపుతున్నాయి. ఆ ఏజెంట్లు ప్రస్తుతం ఎంత అధికారాన్ని కలిగి ఉన్నాయో అవి మనకు చెప్పడం లేదు.
“ప్రొడక్షన్లో చర్యలు తీసుకోవడం” అనేది చాలా విభిన్నమైన ఏర్పాట్లను సూచించవచ్చు. ఒక ఏజెంట్ లాగ్లను సేకరించవచ్చు, ఇన్సిడెంట్ను తెరవవచ్చు, రోల్బ్యాక్ను సిఫార్సు చేయవచ్చు, ప్రమాదకరమైన విడుదలను నిరోధించవచ్చు లేదా ముందుగా నిర్వచించిన రికవరీ దశను అమలు చేయవచ్చు. ప్రతి కార్యకలాపం ప్రొడక్షన్ ఆపరేషన్స్ను తాకుతుంది, కానీ ప్రమాదం ఒక్కటే కాదు.
విశ్వాసానికి సంబంధించిన పరిశోధనలు ఆ తేడాను స్పష్టం చేస్తున్నాయి. ఏజెంట్ ఆధారిత చర్యల కోసం 69 శాతం మంది ప్రతివాదులు వివరణాత్మక వివరణలను కోరారు. తొంభై తొమ్మిది శాతం మంది ఆమోద ద్వారాలు, విధాన పరిమితులు, పాత్ర ఆధారిత యాక్సెస్, ఆడిట్ రికార్డులు లేదా అత్యవసర ఓవర్రైడ్ల వంటి కనీసం ఒక రక్షణ చర్యను కోరుకున్నారు.[2]
అందువల్ల మార్కెట్ సంకేతం “సంస్థలు ఆపరేషన్స్ను AI చేతిలో పెడుతున్నాయి” అనే దానికంటే చాలా సూక్ష్మమైనది. ఒక ఏజెంట్ ఏమి చూడగలదు, ఏమి నిర్ణయించగలదు, ఏమి మార్చగలదు అనే అంశాలపై బలమైన నియంత్రణలను కోరుతూనే సంస్థలు ఆటోమేషన్ను పెంచడానికి సిద్ధంగా ఉన్నట్లు కనిపిస్తున్నాయి.
ఈ అధ్యయన పరిధి కూడా ముఖ్యమైనది. ఈ అధ్యయనం నెట్వర్క్ ఆపరేషన్స్ లీడర్లకు సంబంధించినది. ఇది NetOps దృక్పథాలు, నివేదించబడిన విస్తరణల గురించి ఉపయోగకరమైన ఆధారం. ఇది ప్రతి ఎంటర్ప్రైజ్ వర్క్లోడ్ యొక్క సార్వత్రిక కొలమానం కాదు.
ఒక ఏజెంట్ నిర్ణయాన్ని సొంతం చేసుకోకుండానే ఒక దశను ఎంచుకోగలదు
సాంప్రదాయ ఆటోమేషన్ ఇంజనీర్లు ముందుగా నిర్వచించిన మార్గాన్ని అనుసరిస్తుంది. ఒక పరిమితి దాటినప్పుడు స్క్రిప్ట్ ఒక సర్వీస్ను రీస్టార్ట్ చేస్తుంది. డిప్లాయ్మెంట్ పైప్లైన్ నిర్దిష్ట పరీక్షల శ్రేణిని నడుపుతుంది. ఒక రన్బుక్ తెలిసిన కమాండ్లను తెలిసిన క్రమంలో అమలు చేస్తుంది.
కార్యాచరణ ఏజెంట్ భిన్నమైనది, ఎందుకంటే ఇది సందర్భాన్ని అర్థం చేసుకోగలదు, సాధ్యమయ్యే టూల్స్ లేదా చర్యల మధ్య ఎంపిక చేసుకోగలదు. ఏ లాగ్లను ప్రశ్నించాలి, ఏ డిపెండెన్సీని పరిశీలించాలి, ఏ రికవరీ ప్లేబుక్ ఆధారాలకు బాగా సరిపోతుందో ఇది నిర్ణయించగలదు.
ఇన్సిడెంట్లు ఊహించదగిన క్రమంలో లేనప్పుడు ఆ వెసులుబాటు విలువైనది. అందుకే అధికారాన్ని ఇంటెలిజెన్స్ నుండి వేరుగా పరిగణించాలి.
మోడల్ యొక్క విశ్వాసం (confidence) అనేది ఒక అంచనా మాత్రమే. అది యాక్సెస్ కంట్రోల్ నిర్ణయం కాదు.
సర్వీస్ను రీస్టార్ట్ చేయడం వల్ల ఇన్సిడెంట్ పరిష్కారం అవుతుందని ఒక ఏజెంట్ పూర్తి నమ్మకంతో ఉండవచ్చు. ఆ నమ్మకం ఏజెంట్కు దాన్ని రీస్టార్ట్ చేయడానికి అనుమతి ఉందని, ప్రస్తుత వాతావరణంలో ఆ చర్య సురక్షితమని లేదా దాని పర్యవసానాలకు ఎవరైనా బాధ్యత తీసుకున్నారని రుజువు చేయదు.
అందువల్ల AgenticOps రెండు వేర్వేరు వ్యవస్థలను మిళితం చేస్తుంది:
- ఒక రీజనింగ్ సిస్టమ్ ఏమి జరగాలో ప్రతిపాదిస్తుంది.
- ఒక అథారిటీ సిస్టమ్ దేనికి అనుమతి ఉందో నిర్ణయిస్తుంది.
నిర్వచించిన టాస్క్ సరిహద్దులో ముందుగా అనుమతించబడిన టూల్స్ మరియు దశలను ఏజెంట్ ఎంచుకోవచ్చు. అది ఆ సరిహద్దును విస్తరించకూడదు లేదా తనకు ఎంత అధికారం అర్హమో తానే నిర్ణయించుకోకూడదు.
ప్రస్తుత ప్రాడక్ట్ ఆధారాలు ఏమి రుజువు చేస్తున్నాయి
ప్రస్తుత బలమైన డాక్యుమెంటేషన్ స్థిరమైన దిశను సూచిస్తోంది. ఉపయోగకరమైన కార్యాచరణ ఏజెంట్లు స్పష్టమైన వనరు, అనుమతి, ఆమోద సరిహద్దులలో పనిచేస్తాయి.
| ఆధారాలు | డాక్యుమెంట్ చేయబడిన ప్రవర్తన | ఇది దేనికి మద్దతు ఇస్తుంది | ఇది దేనిని రుజువు చేయదు |
|---|---|---|---|
| సిస్కో మరియు ఓమ్డియా NetOps అధ్యయనం [1][2] | ప్రొడక్షన్ విస్తరణ, కొన్ని స్వయంప్రతిపత్తి మార్పులను అనుమతించడానికి సుముఖత, రక్షణ చర్యల పట్ల బలమైన డిమాండ్ను నివేదిస్తుంది | AgenticOps అనేది ఒక నిజమైన NetOps ధోరణి, విశ్వాస నియంత్రణలు ముఖ్యమైనవిగా మిగిలి ఉన్నాయి | విస్తృత స్వయంప్రతిపత్తి సురక్షితమైనదని స్వతంత్ర ఆధారాలు లేవు |
| AWS DevOps Agent భద్రతా డాక్యుమెంటేషన్ [3][4] | Agent Spaces, IAM పాత్రలు, అనుమతి రక్షణ చర్యలు, రీడ్-ఓన్లీ డిఫాల్ట్లు, ఆడిట్ రికార్డులను ఉపయోగిస్తుంది | ఉపయోగకరమైన దర్యాప్తు అనేది నిర్వచించిన యాక్సెస్ సరిహద్దుపై ఆధారపడి ఉంటుంది | నియంత్రణ లేని రైట్ యాక్సెస్ సరైనదని రుజువు చేయదు |
| Azure SRE Agent డాక్యుమెంటేషన్ [5] | రిసోర్స్ అనుమతులను రివ్యూ మరియు అటానమస్ రన్ మోడ్ల నుండి వేరు చేస్తుంది | యాక్సెస్ హక్కులు మరియు ఆమోద విధానాన్ని స్వతంత్రంగా నిర్వహించాలి | ప్రతి ప్రొడక్షన్ టాస్క్కు అటానమస్ మోడ్ అనుకూలమైనదని కాదు |
| గూగుల్ SRE వివరణ [6] | ఆధారాలను తిరిగి పొందుతుంది, పరిష్కార ప్లేబుక్ల నుండి ఎంచుకుంటుంది, ఫలితాన్ని ధృవీకరిస్తుంది | విశ్వసనీయ చర్య నమూనాలో పరిమిత చర్యల సమితి మరియు ధృవీకరణ ఉంటాయి | పెద్ద ఎత్తున కొలవబడిన ప్రొడక్షన్ ఫలితాన్ని కాదు |
ఈ మూలాలు సమానమైనవి కావు. సిస్కో నివేదిక అనేది ఓమ్డియా నిర్వహించిన మార్కెట్ అధ్యయనం. AWS మరియు మైక్రోసాఫ్ట్ ప్రాడక్ట్ నియంత్రణలను వివరిస్తాయి. గూగుల్ ప్రదర్శన అనేది కొలవబడిన కస్టమర్ ఫలితం కంటే ఒక ఆర్కిటెక్చరల్ ఉదాహరణ మాత్రమే.
ఆ పరిమితులు ఉన్నప్పటికీ, నమూనా స్పష్టంగా ఉంది. దర్యాప్తు, పరస్పర అనుసంధానం, సారాంశం, విడుదల నియంత్రణ, జాగ్రత్తగా పరిమితం చేయబడిన చర్యలకు బహిరంగ ఆధారాలు బలంగా ఉన్నాయి. ప్రొడక్షన్ సిస్టమ్లలో నియంత్రణ లేని మార్పుల విషయంలో ఆధారాలు చాలా బలహీనంగా ఉన్నాయి.
ఈ నమూనా AgenticOps గురించి మరింత ఉపయోగకరంగా చర్చించే విధానానికి నన్ను నడిపించింది. ఎంపిక అనేది మాన్యువల్ ఆపరేషన్స్ మరియు పూర్తి స్వయంప్రతిపత్తి మధ్య మాత్రమే కాదు. ఇది కార్యాచరణ అధికారం యొక్క నిచ్చెన.
ఏజెంట్ అథారిటీ నిచ్చెన
యాక్సెసిబిలిటీ కోసం, ఈ ఫ్రేమ్వర్క్ క్రింద కూడా ఇవ్వబడింది.
- పరిశీలించడం (Observe): ఏజెంట్ టెలిమెట్రీని సేకరించి సాధారణీకరిస్తుంది. మనుషులు విశ్వసనీయ వనరులను, యాక్సెస్ సరిహద్దులను నిర్వచిస్తారు.
- దర్యాప్తు చేయడం (Investigate): ఏజెంట్ ఆధారాలను అనుసంధానిస్తుంది మరియు సాధ్యమయ్యే వివరణలను పరీక్షిస్తుంది. మనుషులు అనిశ్చితిని సమీక్షిస్తారు మరియు ముగింపులను ప్రశ్నిస్తారు.
- సిఫార్సు చేయడం (Recommend): ఏజెంట్ రన్బుక్, పరిష్కారం లేదా విడుదల తీర్పును ప్రతిపాదిస్తుంది. మనుషులు ఆ సిఫార్సును అంగీకరిస్తారు, తిరస్కరిస్తారు లేదా సవరిస్తారు.
- ఆమోదిత చర్య (Approved action): ఆమోదం పొందిన తర్వాత ఏజెంట్ స్పష్టంగా వివరించిన ఒక మార్పును అమలు చేస్తుంది. బాధ్యతాయుతమైన ఆపరేటర్ ప్రభావాన్ని అంచనా వేసి దాన్ని అనుమతిస్తారు.
- పరిమిత స్వయంప్రతిపత్తి (Bounded autonomy): ఏజెంట్ ముందుగా నిర్వచించిన, రివర్స్ చేయగల చర్యల తరగతిని అమలు చేస్తుంది. మనుషులు విధానాన్ని నిర్ణయిస్తారు, ప్రవర్తనను పర్యవేక్షిస్తారు మరియు ఓవర్రైడ్ అధికారాన్ని తమ వద్దే ఉంచుకుంటారు.
ఒక స్థాయి నుండి తదుపరి స్థాయికి మారడం అనేది కేవలం మోడల్ అప్గ్రేడ్ మాత్రమే కాదు. ఇది అనుమతులు, ప్రమాదం, జవాబుదారీతనానికి సంబంధించి సంస్థ తీసుకునే నిర్ణయం.
ఒక బృందం ప్రతి ప్రొడక్షన్ ఇన్సిడెంట్ను దర్యాప్తు చేయడానికి ఏజెంట్ను నమ్మవచ్చు, కానీ చాలా పరిమిత చర్యలను మాత్రమే అమలు చేయడానికి అనుమతించవచ్చు. మరొక బృందం స్టేట్లెస్ డెవలప్మెంట్ సర్వీస్లకు ఆటోమేటిక్ రీస్టార్ట్లను అనుమతించవచ్చు, కానీ చెల్లింపుల వ్యవస్థలో అదే చర్యకు ఆమోదం తప్పనిసరి చేయవచ్చు.
రెండు వాతావరణాలలోనూ మోడల్ ఒకేలా ఉండవచ్చు. కానీ తగిన అధికారం ఒకేలా ఉండదు.
రీస్టార్ట్ నిర్ణయానికి తిరిగి వస్తే
ప్రారంభ దృశ్యంలోని సర్వీస్ రీస్టార్ట్పై ఏజెంట్ చర్య తీసుకునే ముందు, నాలుగు ప్రశ్నలకు సమాధానాలు అవసరం.
1. దీనికి తగినంత కార్యాచరణ సందర్భం ఉందా?
కేవలం ఒక ఎర్రర్ లాగ్ ఆధారంగా ఇచ్చే సిఫార్సు, డిప్లాయ్మెంట్ చరిత్ర, డిపెండెన్సీ టోపోలాజీ, రిసోర్స్ మెట్రిక్స్, ఇటీవలి కాన్ఫిగరేషన్ మార్పులు, ఇలాంటి ఇన్సిడెంట్ల ఆధారంగా ఇచ్చే సిఫార్సు కంటే చాలా భిన్నంగా ఉంటుంది.
లోపించిన టెలిమెట్రీని కేవలం నమ్మకంగా రీజనింగ్ చేయడం ద్వారా ఏజెంట్ భర్తీ చేయలేదు. అందువల్ల కార్యాచరణ స్వయంప్రతిపత్తి కంటే ముందు అబ్జర్వబిలిటీ పరిపక్వత వస్తుంది. యాజమాన్యం, డిపెండెన్సీలు, ఇన్సిడెంట్ చరిత్ర విచ్ఛిన్నమై ఉంటే, ఏజెంట్ కూడా ఆ విచ్ఛిన్నతను వారసత్వంగా పొందుతుంది.
2. ఈ చర్య స్పష్టంగా అనుమతించబడిందా?
ఏజెంట్ కనీస అధికారాల (least-privilege) యాక్సెస్తో కూడిన పరిమిత గుర్తింపు ద్వారా పనిచేయాలి. దాని టూల్స్, లక్ష్య వనరులు, అనుమతించబడిన చర్యలు మోడల్ వెలుపల నిర్వచించబడాలి. “జాగ్రత్తగా ఉండండి” అని ఏజెంట్కు ప్రాంప్ట్ ఇవ్వడం భద్రతా నియంత్రణ కాదు.
AWS ఈ విభజనను Agent Spaces, IAM పాత్రలు, అనుమతి రక్షణ చర్యల ద్వారా డాక్యుమెంట్ చేస్తుంది. మైక్రోసాఫ్ట్ Azure SRE Agent లో రిసోర్స్ అనుమతులను, ఇన్ఫ్రాస్ట్రక్చర్ చర్యలకు ఆమోదం అవసరమా కాదా అని నిర్ణయించే రన్ మోడ్ నుండి వేరు చేయడం ద్వారా ఉపయోగకరమైన పోలికను అందిస్తుంది.
ఉత్పత్తులు వేర్వేరుగా ఉండవచ్చు, కానీ శాశ్వత సూత్రం ఒక్కటే. సామర్థ్యం మరియు అనుమతిని స్వతంత్రంగా నిర్వహించాలి.
3. అవసరమైన ఆమోదం పూర్తి సమాచారంతో కూడినదేనా?
రీస్టార్ట్ను ఆమోదించడానికి ముందు, ఆపరేటర్ వీటిని చూడగలగాలి:
- రోగనిర్ధారణకు మద్దతు ఇచ్చే ఆధారాలు.
- ప్రతిపాదించబడుతున్న ఖచ్చితమైన చర్య.
- ప్రభావితమయ్యే వ్యవస్థలు మరియు వినియోగదారులు.
- ఆశించిన రికవరీ సంకేతం.
- రోల్బ్యాక్ లేదా ప్రత్యామ్నాయ ప్రతిస్పందన.
- విజయం లేదా వైఫల్యాన్ని నిర్ణయించే పరిస్థితులు.
ఆపరేటర్ ఆ అంశాలను అర్థం చేసుకోలేకపోతే, ఆమోదం కేవలం ఒక లాంఛనంగా మారుతుంది. చర్యను అంచనా వేయడానికి ఆధారాలు, సమయం లేదా అధికారం లేని వ్యక్తి బటన్ నొక్కినంత మాత్రాన అది అర్థవంతమైన మానవ నియంత్రణను సృష్టించదు.
OWASP Top 10 for Agentic Applications 2026 మితిమీరిన ఏజెన్సీ (excessive agency) చుట్టూ విస్తృత భద్రతా హెచ్చరికను అందిస్తుంది.[7] ఆపరేషన్స్ కోసం ఆచరణాత్మక పాఠం చాలా సులభం. తక్కువ ప్రమాదం ఉన్న దర్యాప్తు టూల్స్ కంటే ఎక్కువ ప్రభావం చూపే టూల్స్కు బలమైన అనుమతి సరిహద్దులు అవసరం.
4. ఫలితాన్ని ధృవీకరించగలమా?
కమాండ్ను అమలు చేయడంతో కార్యాచరణ చర్య ముగిసిపోదు. ఎర్రర్ రేట్లు తగ్గాయా, ట్రాఫిక్ పునరుద్ధరించబడిందా, డిపెండెన్సీలు స్థిరపడ్డాయా, కస్టమర్లపై ప్రభావం ముగిసిందా లేదా అనే విషయాన్ని సిస్టమ్ నిర్ధారించాలి.
రికవరీని స్థాపించలేకపోతే, ఏజెంట్ వీలైన చోట రోల్బ్యాక్ చేయాలి లేదా సేకరించిన ఆధారాలతో ఎస్కలేట్ చేయాలి. ఆ లూప్ లేకపోతే, ఏజెంట్ కమాండ్ విజయవంతంగా అమలు కావడాన్ని ఇన్సిడెంట్ విజయవంతంగా పరిష్కారమైనట్లు పొరబడవచ్చు.
మానవ ఆమోదం ఎల్లప్పుడూ అత్యంత సురక్షితమైన సమాధానం కాదు
ప్రతి చర్యకు ఒక వ్యక్తి ఆమోదం తప్పనిసరి చేయడం ద్వారా ప్రతి AgenticOps ప్రమాదాన్ని పరిష్కరించవచ్చని అనుకోవడం సహజం. కానీ అది ఆచరణీయమని నేను భావించడం లేదు.
వేగంగా కదిలే అంతరాయం సమయంలో ఆమోద అభ్యర్థన సమాధానం లేకుండా మిగిలిపోవచ్చు. బాగా అలసిపోయిన ఇంజనీర్ ఆధారాలను సరిగ్గా సమీక్షించకుండానే ఆమోదించవచ్చు. వందలాది తక్కువ-ప్రమాదకర చర్యలకు మానవ నిర్ధారణను కోరడం వల్ల అలర్ట్ అలసట ఏర్పడి, నిజంగా అవసరమైన చోట పర్యవేక్షణ నాణ్యత తగ్గవచ్చు.
కొన్ని వాతావరణాలలో ఆలస్యమైన మానవ జోక్యం కంటే పరిమిత స్వయంప్రతిపత్తి మరింత సురక్షితమైనది కావచ్చు. చర్య పునరావృతం చేయదగినదిగా, పరిశీలించదగినదిగా, రివర్స్ చేయదగినదిగా ఉన్నప్పుడు స్టేట్లెస్ వర్కర్ను రీస్టార్ట్ చేయడం, ముందుగా నిర్వచించిన సర్వీస్ శ్రేణిని స్కేల్ చేయడం లేదా లోపభూయిష్ట డిప్లాయ్మెంట్ను పాజ్ చేయడం సరైన పరిష్కారం కావచ్చు.
లక్ష్యం ప్రతి అమలు మార్గంలోనూ మనిషిని ఉంచడం కాదు. చర్యకు తగినట్లుగా అధికారాన్ని సరిపోల్చడం.
| చర్య ఇలా ఉన్నప్పుడు ముందే అప్పగించండి | చర్య వీటిపై ప్రభావం చూపినప్పుడు స్పష్టమైన ఆమోదాన్ని ఉంచండి |
|---|---|
| పునరావృతం చేయదగినది మరియు స్పష్టంగా అర్థమయ్యేది | గుర్తింపు లేదా యాక్సెస్ నియంత్రణ (Identity or access control) |
| ప్రభావ పరిధి (blast radius) తక్కువగా ఉండటం | ఫైర్వాల్ మరియు నెట్వర్క్ భద్రతా విధానం |
| అమలుకు ముందు మరియు తరువాత పరిశీలించదగినది | ప్రొడక్షన్ డేటాబేస్లు లేదా స్థిరమైన డేటా |
| పరీక్షించబడిన మార్గం ద్వారా రివర్స్ చేయదగినది | విధ్వంసక నిల్వ కార్యకలాపాలు (Destructive storage operations) |
| మరింత నష్టం లేకుండా మళ్లీ ప్రయత్నించడానికి సురక్షితమైనది | అస్పష్టమైన యాజమాన్యం కలిగిన ఉమ్మడి ఇన్ఫ్రాస్ట్రక్చర్ |
| విధానం మరియు పూర్తి ఆడిట్ రికార్డులతో కూడినది | నియంత్రిత లేదా సమ్మతి సున్నితమైన వ్యవస్థలు (Regulated systems) |
ఇది ఒక ప్రారంభ బిందువు మాత్రమే, సార్వత్రిక అనుమతుల జాబితా కాదు. వేర్వేరు వ్యవస్థలలో ఒకే చర్య వేర్వేరు ప్రమాదాలను కలిగి ఉండవచ్చు.
ఏజెంట్ అధికారం మానవ అధికారాన్ని తొలగించదు
ఒక ఏజెంట్ అనుమతిని పొందగలదు. కానీ అది సంస్థాగత జవాబుదారీతనాన్ని స్వీకరించలేదు.
ఏ ఆధార వనరులు విశ్వసనీయమైనవి, ఏ టూల్స్ అందుబాటులో ఉన్నాయి, ఏ వాతావరణాలను మార్చవచ్చు, ఏ వైఫల్యాలకు ఎస్కలేషన్ అవసరమో ఎవరో ఒకరు నిర్ణయించాలి. ఏజెంట్ సరిగ్గా పనిచేసినప్పటికీ, విధానానికి ఒక నిర్దిష్ట సర్వీస్ యజమాని బాధ్యత వహించాలి.
విభజన స్పష్టంగా ఉండాలి. ఏజెంట్ ఆధారాలను సేకరించడం, తన రీజనింగ్ను వివరించడం, అనుమతించబడిన చర్యల నుండి ఎంచుకోవడం, ఫలితాన్ని నివేదించడం ద్వారా తనకు కేటాయించిన టాస్క్ సరిహద్దులో పనిచేస్తుంది. మానవ అధికారం ఆ సరిహద్దును సృష్టిస్తుంది, అధిక-ప్రభావ మినహాయింపులను ఆమోదిస్తుంది, వైఫల్యాలను సమీక్షిస్తుంది, అనుమతులు విస్తరించాలా, అలాగే ఉండాలా లేదా తగ్గించాలా అని నిర్ణయిస్తుంది.
అందుకే “ల్యాప్లో మనిషి (human in the loop)” అనేది పాలనా నమూనాగా ఉపయోగపడటానికి చాలా అస్పష్టమైన పదం. ముఖ్యమైన ప్రశ్న ఏమిటంటే వర్క్ఫ్లోలో మనిషి కనిపిస్తారా లేదా అనేది కాదు. ఏ నిర్ణయాలు మానవ నిర్ణయాలుగా మిగిలి ఉంటాయనేది ముఖ్యం.
వేగవంతమైన పరిష్కారం మాత్రమే పూర్తి స్కోర్కార్డ్ కాదు
సగటు పరిష్కార సమయాన్ని (MTTR) తగ్గించడం ఉపయోగకరమే, కానీ MTTR అనేది నమ్మకానికి కొలమానం కాదు.
ఒక వ్యవస్థ దూకుడుగా వ్యవహరించడం ద్వారా, తక్కువ కేసులను ఎస్కలేట్ చేయడం ద్వారా లేదా అంతర్లీన సమస్య తొలగించబడక ముందే రికవరీని ప్రకటించడం ద్వారా పరిష్కార సమయాన్ని తగ్గించవచ్చు. ఒక ఇన్సిడెంట్ త్వరగా మూసివేయబడి గంట తర్వాత మళ్లీ రావచ్చు.
| కొలమానం | ఇది ఏమి వెల్లడిస్తుంది |
|---|---|
| ఉపయోగకరమైన ఆధారాలు లభించే సమయం | ఏజెంట్ దర్యాప్తును వేగవంతం చేస్తుందా లేదా |
| సిఫార్సుల అంగీకార రేటు | ఇంజనీర్లు దాని ముగింపులను ఉపయోగకరంగా భావిస్తున్నారా లేదా |
| నిర్ణయం తీసుకోకుండా ఆగిపోయే నాణ్యత (Abstention quality) | ఆధారాలు సరిపోనప్పుడు అది గుర్తిస్తుందా లేదా |
| మానవ ఓవర్రైడ్ రేటు | ఆపరేటర్లు దాని నిర్ణయాలను ఎంత తరచుగా తిరస్కరిస్తారు లేదా అడ్డుకుంటారు |
| రోల్బ్యాక్ విజయవంత రేటు | విఫలమైన చర్యలను సురక్షితంగా రికవర్ చేయగలరా లేదా |
| ఇన్సిడెంట్ పునరావృతం కావడం | చర్య అసలు కారణాన్ని సరిదిద్దిందా లేదా లక్షణాన్ని మాత్రమే తాత్కాలికంగా అణచివేసిందా |
| విధాన ఉల్లంఘన రేటు | ఏజెంట్ తన అధికార పరిధిలోనే ఉందా లేదా |
| ఆడిట్ సంపూర్ణత | ఏమి జరిగిందో పరిశోధకులు పునర్నిర్మించగలరా లేదా |
ఒక బలమైన పైలట్ ఈ భద్రత మరియు నాణ్యత చర్యలను బలహీనపరచకుండా వేగాన్ని మెరుగుపరచాలి.
బృందాలు ఎక్కడ ప్రారంభించాలి
అత్యంత సురక్షితమైన ప్రారంభ స్థానం స్వయంప్రతిపత్తి పరిష్కారం కాదు. అది కార్యాచరణ అవగాహన.
ముందుగా ఏజెంట్లను పరిశీలించనివ్వండి. ఆమోదించబడిన టెలిమెట్రీ, డిప్లాయ్మెంట్ రికార్డులు, ఇన్సిడెంట్ చరిత్ర, సర్వీస్ డాక్యుమెంటేషన్కు వాటికి యాక్సెస్ ఇవ్వండి. అవి సరైన ఆధారాలను సేకరిస్తున్నాయా లేదా మరియు వాటి సారాంశాలు ఖచ్చితమైనవా లేదా అని కొలవండి.
ఆ తర్వాత వాటిని దర్యాప్తు చేయడానికి, సిఫార్సు చేయడానికి అనుమతించండి. అనుభవజ్ఞులైన ఇంజనీర్ల ముగింపులతో వాటి ఫలితాలను పోల్చండి. ఏజెంట్ ఎప్పుడు సరైనదో, ఎప్పుడు నిర్ణయం తీసుకోకుండా ఆగిపోయిందో, ఎప్పుడు నమ్మకంగా ఉంటూనే అసంపూర్ణ వివరణను ఇచ్చిందో రికార్డ్ చేయండి.
సిఫార్సు ప్రక్రియ ఆధారపడదగినదిగా మారినప్పుడు మాత్రమే ఆమోదిత చర్యలు అనుసరించాలి. అప్పుడు కూడా ఇరుకైన, రివర్స్ చేయగల మార్పులతో ప్రారంభించండి మరియు అమలుకు ముందు ఆశించిన ఫలితాన్ని తెలియజేయాలని సిస్టమ్ను కోరండి.
పరిమిత స్వయంప్రతిపత్తి అనేది చర్య తరగతి వారీగా సంపాదించబడాలి. వేరే పనిలో మోడల్ బాగా పనిచేసినంత మాత్రాన దానికి విస్తృత స్వయంప్రతిపత్తి ఇవ్వకూడదు.
స్టేట్లెస్ వర్కర్లను నమ్మకంగా రీస్టార్ట్ చేసే ఏజెంట్, ఫైర్వాల్ విధానాన్ని మార్చగలదని నిరూపించినట్లు కాదు. డిప్లాయ్మెంట్లను సమీక్షించే ఏజెంట్, డేటాబేస్ స్కీమాలను మార్చే అనుమతిని పొందినట్లు కాదు. అధికారం నిర్దిష్ట ఆధారాల ద్వారా విస్తరించాలి, సాంకేతికతపై సాధారణ నమ్మకం ద్వారా కాదు.
విశ్వాసం ఒక్కో పరిమిత నిర్ణయంతోనే సంపాదించబడుతుంది
ప్రారంభంలో ప్రతిపాదించిన సర్వీస్ రీస్టార్ట్కు మరోసారి వద్దాం.
ఇంజనీర్ కోసం వేచి ఉండకుండానే దాన్ని అమలు చేయడానికి ఏజెంట్కు అనుమతి ఉండవచ్చు, కానీ ఈ తరగతి రీస్టార్ట్ అనుమతించబడినదిగా, రివర్స్ చేయదగినదిగా, ధృవీకరించదగినదిగా సంస్థ ఇప్పటికే నిర్ణయించినట్లయితే మాత్రమే అది సాధ్యమవుతుంది. ఇన్సిడెంట్ సమయంలో ఏజెంట్ స్వయంగా ఆ అధికారాన్ని సృష్టించుకోకూడదు.
డిపెండెన్సీలు అస్పష్టంగా ఉంటే, ప్రభావ పరిధి అనిశ్చితంగా ఉంటే లేదా రికవరీని కొలవలేకపోతే, సిఫార్సు చేయడం మరియు ఎస్కలేట్ చేయడమే సరైన చర్య కావచ్చు. అది AgenticOps వైఫల్యం కాదు. ఎప్పుడు చర్య తీసుకోకూడదో తెలుసుకోవడం కూడా కార్యాచరణ నైపుణ్యంలో భాగమే.
మార్కెట్ వేగంగా ముందుకు సాగుతోంది, వాటి సామర్థ్యాలు మెరుగుపడే కొద్దీ కార్యాచరణ ఏజెంట్లు మరింత అధికారాన్ని పొందుతాయి. ఆమోద ద్వారాలను అత్యంత వేగంగా తొలగించే సంస్థలు ఎక్కువ ప్రయోజనం పొందలేవు. ప్రతి ద్వారం ఎందుకు ఉందో, ఎప్పుడు దాన్ని సురక్షితంగా తొలగించవచ్చో, మిగిలిన నియంత్రణలు వైఫల్యాన్ని ఎలా గుర్తిస్తాయో అర్థం చేసుకునే సంస్థలే ఎక్కువ ప్రయోజనం పొందుతాయి.
AgenticOps అనేది ఆపరేషన్స్ నుండి మనుషులను తొలగించడం గురించి కాదు. ఏ నిర్ణయాలను ఏజెంట్ తీసుకోవచ్చు, వేటికి ఆమోదం అవసరం, ఏవి మనుషుల వద్దే ఉండాలో జాగ్రత్తగా, స్పష్టంగా నిర్ణయించడం గురించినది.
మూలాలు మరియు తదుపరి పఠనం
28 సెప్టెంబర్ 2026న మూలాలు, డాక్యుమెంటేషన్ సమీక్షించబడ్డాయి. ప్రారంభంలో పేర్కొన్న ఇన్సిడెంట్ ఒకే కస్టమర్ అంతరాయ నివేదిక కంటే వివరణాత్మక దృశ్యం మాత్రమే.
- The Impact of Agentic AI on Network Operations, Cisco and Omdia, 2026. ఉత్తర అమెరికా, పశ్చిమ ఐరోపా, ఆసియా పసిఫిక్ ప్రాంతాల్లోని 1,000 కంటే ఎక్కువ మంది NetOps లీడర్లను అడాప్షన్, స్వయంప్రతిపత్తి చర్యలు, రక్షణ చర్యల డిమాండ్పై సర్వే చేసిన పరిశోధనా నివేదిక. ↩
- NetOps Is Already Deploying Autonomy. Trust Will Decide How Far It Goes, Cisco, September 2026. సర్వే ఫలితాలు, స్వయంప్రతిపత్తి నెట్వర్క్ చర్యల చుట్టూ ఉన్న విశ్వాస అవసరాలపై సిస్కో కార్యాచరణ విశ్లేషణ. ↩
- AWS DevOps Agent Security, AWS, 28 సెప్టెంబర్ 2026న సమీక్షించబడింది. Agent Spaces, గుర్తింపు ఐసోలేషన్, కార్యాచరణ డేటా నిర్వహణ, జర్నల్స్, ఆడిట్ ట్రయల్స్ను కవర్ చేసే అధికారిక డాక్యుమెంటేషన్.
- Limiting Agent Access in an AWS Account, AWS, 28 సెప్టెంబర్ 2026న సమీక్షించబడింది. IAM పాత్రలు, అనుమతి రక్షణ చర్యలు, ప్రభావవంతమైన యాక్సెస్ నియంత్రణలపై సాంకేతిక మార్గదర్శకత్వం.
- Run Modes in Azure SRE Agent, Microsoft, 28 సెప్టెంబర్ 2026న సమీక్షించబడింది. వనరుల అనుమతులు మరియు రివ్యూ వర్సెస్ అటానమస్ అమలు రీతుల మధ్య విభజనను ప్రదర్శించే ఆర్కిటెక్చర్ డాక్యుమెంటేషన్.
- How Google SREs Use Gemini CLI to Solve Real-World Outages, Google Cloud, January 2026. ఆధారాల సేకరణ, క్లోజ్డ్ ప్లేబుక్ పరిష్కారం, మానవ ఆమోదం, ఫలితాల ధృవీకరణను ప్రదర్శించే ఆచరణాత్మక వివరణ.
- OWASP Top 10 for Agentic Applications 2026, OWASP GenAI Security Project, December 2025. మితిమీరిన ఏజెన్సీ మరియు కఠినమైన కార్యాచరణ అధికార సరిహద్దుల ఆవశ్యకతను వివరించే భద్రతా మార్గదర్శకత్వం. ↩
- AI Risk Management Framework (AI RMF 1.0), NIST, 28 సెప్టెంబర్ 2026న సమీక్షించబడింది. ఆర్టిఫిషియల్ ఇంటెలిజెన్స్ వ్యవస్థలలో ప్రమాదాలను నిర్వహించడానికి ఫెడరల్ పునాది ప్రమాణం.
