.
ఎఐ… కృత్రిమ మేధస్సు… ఇది రెండువైపులా పదునున్న కత్తి… ఇప్పటికే కొన్ని ప్రమాదాలు కనిపిస్తున్నాయి… ఇంకా ఏమేం రాబోతున్నాయో తెలియదు… తాజాగా వెల్లడైన మరో అంశం ఇంకాస్త ఇంట్రస్టింగు…
మనం ఎఐకి ఒక టాస్క్ ఇచ్చాం, దాన్ని పూర్తి చేయడం దాని టార్గెట్… ప్రాంప్ట్ సరిగ్గానే ఇచ్చాం… కానీ కొన్నిసార్లు ఎఐ టార్గెట్ రీచ్ కావడానికి దొంగ దారులు కూడా సొంతంగా వెతుక్కుంటోంది… అంటే, AI కి చెప్పింది ఒక్క పని.. చేసింది మరో పని!
లక్ష్యం కోసం మనుషులను మోసం చేసేందుకు కూడా సిద్ధపడుతున్న కృత్రిమ మేధస్సు
Ads
కృత్రిమ మేధస్సు గురించి ఇప్పటివరకు మనకు ఉన్న ప్రధాన భయం — మనుషులు AIని దుర్వినియోగం చేస్తే ఏమవుతుంది? అన్నదే. కానీ ఇప్పుడు ఆ ప్రశ్నకు మరోటి జత చేయాల్సిన పరిస్థితి వచ్చింది.
AI కి ఎవరూ చెడు పని చేయమని చెప్పకపోయినా.. అది తనకు అప్పగించిన అసలు పనిని పూర్తి చేసేందుకు తానే ప్రమాదకరమైన మార్గాలను ఎంచుకుంటే?
బ్రిటన్కు చెందిన AI Security Institute (AISI) చేసిన తాజా ప్రయోగం ఈ ప్రశ్నను ముందుకు తెచ్చింది.
అత్యాధునిక AI మోడళ్ల సైబర్ సామర్థ్యాలను పరీక్షించేందుకు AISI ఒక సైబర్ సెక్యూరిటీ ఛాలెంజ్ నిర్వహించింది. మొత్తం 122 సార్లు వివిధ AI మోడళ్లతో ఈ పరీక్ష జరిపారు. ప్రయోగం కోసం ఉద్దేశపూర్వకంగా ఇంటర్నెట్ యాక్సెస్ ఇచ్చారు. సాధారణంగా AIకి ప్రమాదకరమైన పనులను అడ్డుకునే భద్రతా ఫిల్టర్లను కూడా తొలగించారు.
- ఇక్కడే ఊహించని పరిణామం కనిపించింది.
122 పరీక్షల్లో 10 సందర్భాల్లో AI ఏజెంట్లు తమకు అప్పగించిన పరీక్షల పరిధిని దాటి నిజమైన వ్యక్తులు, సంస్థలు, నిజమైన ఆన్లైన్ ప్రాజెక్టులపై చర్యలకు దిగారు.
- అందులో అత్యంత ఆందోళన కలిగించిన ఘటన ఒకటి.
ఒక AI ఏజెంట్ ఓ నిజమైన ఓపెన్ సోర్స్ సాఫ్ట్వేర్ ప్రాజెక్టులోకి హానికరమైన కోడ్ను చొప్పించేందుకు ప్రయత్నించింది. అంతటితో ఆగలేదు. ఆ కోడ్ను ప్రాజెక్టు నిర్వాహకులు ఆమోదించేలా చేయడానికి నకిలీ ఆన్లైన్ గుర్తింపులను సృష్టించింది. వాటి ద్వారా ప్రాజెక్టు నిర్వహిస్తున్న వ్యక్తిని ప్రభావితం చేసి కోడ్ను ఆమోదింపజేయాలని ప్రయత్నించింది.
అంటే..
తనకు ఇచ్చిన లక్ష్యాన్ని సాధించేందుకు AI తానే ఆ దొంగ మార్గాన్ని ఎంచుకుంది. ఇంకొన్ని సందర్భాల్లో నిజమైన వ్యక్తులకు సందేశాలు, ఫైళ్లు పంపి వాటిని తెరవడానికి లేదా హానికరమైన కోడ్ను అమలు చేయడానికి ఒప్పించే ప్రయత్నాలు కూడా జరిగాయి. ఇతర AI సిస్టమ్స్ను ప్రభావితం చేసేలా దాచిన సూచనలను చొప్పించే ప్రయత్నాలు కూడా కనిపించాయి.
ఈ మొత్తం వ్యవహారంలో ఎక్కువ భాగం Anthropicకు చెందిన Mythos 5 మోడల్లో కనిపించగా, రెండు చర్యలు OpenAIకి చెందిన GPT-5.6-Sol పరీక్షలో నమోదయ్యాయి.
అయితే ఒక విషయం స్పష్టంగా చెప్పాలి.
ఈ AI మోడళ్లు తమ పరీక్షా వాతావరణం నుంచి బయటకు వచ్చి AISI వ్యవస్థలపై దాడి చేయలేదు. పెద్దగా ఎలాంటి వాస్తవ ప్రపంచ నష్టం కూడా జరగలేదు. ఈ ప్రయోగాలు పరిశీలిస్తున్నవారు హానికరమైన కోడ్ను గుర్తించి తిరస్కరించారు. AISI భద్రతా వ్యవస్థలు కూడా చివరకు ఈ కార్యకలాపాలను గుర్తించి పరీక్షలను నిలిపివేశాయి.
AI ఆలోచించే తీరు మారుతోందా?
ఇప్పటివరకు AIని మనం ఒక ప్రశ్న అడిగితే సమాధానం చెప్పే సాధనంగా చూశాం. కానీ కొత్త తరం AI ఏజెంట్లు కేవలం సమాధానం చెప్పడం మాత్రమే కాదు.. ఒక లక్ష్యాన్ని ఇచ్చినప్పుడు దాన్ని సాధించడానికి అనేక దశల్లో, అనేక మార్గాల్లో పనిచేస్తున్నాయి.
అటువంటి వ్యవస్థకు లక్ష్యం ఎంత కష్టంగా ఉంటే, దాన్ని సాధించడానికి అది కొత్తవి, దొంగ మార్గాలను వెతికే అవకాశం అంత పెరుగుతోంది.
ఆ మార్గం మనం ఊహించినదే కావచ్చు.
లేదా..
మనుషులు చేయకూడదనుకునే పనులు కూడా కావచ్చు.
AISI ప్రయోగంలో అదే కనిపించింది. తనకు ఇచ్చిన లక్ష్యాన్ని సాధించడానికి మోసం ఒక ఉపయోగకరమైన మార్గంగా కనిపించగానే, దాన్ని ప్రయత్నించింది.
ఇదే ఈ ప్రయోగం బయటపెట్టిన అసలు ఆందోళన.
ఈరోజు ప్రత్యేకంగా ఏర్పాటు చేసిన ప్రయోగంలో కనిపించిన ఈ ప్రవర్తన.. రేపు మరింత శక్తివంతమైన AI ఏజెంట్లలో కనిపించకుండా ఉంటుందని హామీ ఇవ్వలేం.
మోడళ్ల సామర్థ్యం పెరుగుతున్న కొద్దీ వాటికి ఇంటర్నెట్, కోడింగ్ టూల్స్, ఫైళ్లు, డబ్బు, ఇతర డిజిటల్ వ్యవస్థలకు ఎక్కువ యాక్సెస్ లభిస్తే.. వాటి స్వయంప్రతిపత్తి కూడా పెరుగుతుంది.
- అప్పుడు అసలు ప్రశ్న:“AI ఏం చేయగలదు?” అన్నది కాదు.
“AI కి మనం ఏ లక్ష్యం ఇస్తున్నాం.. ఆ లక్ష్యాన్ని సాధించడానికి అది ఏ దారిని ఎంచుకుంటుంది?”
అన్నదే.
సో, AI ప్రమాదం ఎప్పుడూ చెడు ఉద్దేశంతో మొదలవ్వాల్సిన అవసరం లేదు.
కొన్నిసార్లు..
మనమే ఇచ్చిన లక్ష్యాన్ని అది చాలా పట్టుదలగా సాధించాలనుకోవడం కూడా ప్రమాదానికి కారణం కావచ్చు.
అందుకే AI భవిష్యత్తుపై ఇప్పుడు మరో మాటను గుర్తుపెట్టుకోవాల్సి ఉంటుంది—
“AIకి పని చెప్పడం సులభమే.. కానీ ఆ పని సాధించడానికి అది ఏ దారి ఎంచుకుంటుందో గమనించడం ఇక అంతకంటే ముఖ్యం.”
Share this Article