మన మాట వినకుండా ఏఐ ఏం చేస్తోంది? సంచలన ఘటనలు బయటపెట్టిన ఓపెన్‌ఏఐ

మన మాట వినకుండా ఏఐ ఏం చేస్తోంది? సంచలన ఘటనలు బయటపెట్టిన ఓపెన్‌ఏఐ

OpenAI reveals sensational incidents of AI models behaving unexpectedly
  • ఏఐ మోడళ్ల అనూహ్య ప్రవర్తనపై ఓపెన్‌ఏఐ నివేదికలు
  • తప్పులను ఏఐ దాచిపెట్టిన ఘటనలు గుర్తించిన సంస్థ
  • సమాచారం లేకపోతే డేటాను సృష్టించిన ఏఐ మోడల్‌
  • గిట్‌హబ్‌లో ‘ఏపీఐ కీ’ల కోసం మోడల్‌ వెతుకులాట
  • అనుమతి లేకుండా ఫైళ్లను పబ్లిక్‌ సైట్లలోకి అప్‌లోడ్‌ చేసిన ఏజెంట్లు
మనం ఇచ్చిన ఆదేశాల ప్రకారమే ఏఐ పనిచేస్తుందనుకుంటాం. కానీ కొన్ని సందర్భాల్లో ఏఐ మోడళ్లు అందుకు భిన్నంగా వ్యవహరిస్తున్నాయి. చేసిన తప్పులను దాచడం, సమాచారం అందుబాటులో లేకపోతే డేటాను సృష్టించడం, అనుమతి లేకుండా ‘ఏపీఐ కీ’ల కోసం వెతకడం, స్థానికంగా ఉండాల్సిన ఫైళ్లను పబ్లిక్‌ వెబ్‌సైట్లలోకి అప్‌లోడ్‌ చేయడం వంటి ఘటనలను ఓపెన్‌ఏఐ గుర్తించింది. దీంతో తమ ఏఐ మోడళ్లలో చోటుచేసుకునే అనూహ్య, అనధికార ప్రవర్తనపై ఇకపై క్రమం తప్పకుండా నివేదికలు విడుదల చేయాలని సంస్థ నిర్ణయించింది.

ఇలాంటి ప్రవర్తనను ఓపెన్‌ఏఐ ‘మిస్‌అలైన్‌మెంట్‌’గా పేర్కొంది. అంటే డెవలపర్లు నిర్దేశించిన లక్ష్యాలు, పరిమితులు, భద్రతా నియమాలకు విరుద్ధంగా ఏఐ మోడల్‌ వ్యవహరించడం. ఇప్పటివరకు ఇలాంటి ఘటనలపై అప్పుడప్పుడు మాత్రమే వివరాలు వెల్లడించామని సంస్థ తెలిపింది. ఇకపై ఘటనపై పూర్తి కారణం తెలియకపోయినా, సమస్యను పూర్తిగా పరిష్కరించే చర్యలు ఇంకా పూర్తికాకపోయినా నివేదికలను విడుదల చేయాలని నిర్ణయించింది.

తప్పులను దాచే ప్రయత్నం
ఓపెన్‌ఏఐ విడుదల చేసిన తొలి ఆరు నివేదికల్లో ఆసక్తికర విషయాలు వెలుగులోకి వచ్చాయి. ఒక శిక్షణ పరీక్షలో జీపీటీ-5.6 Sol మోడల్‌ టాస్క్‌ సారాంశాల్లో భవిష్యత్‌ వెర్షన్లకు సూచనలు చేర్చినట్లు తెలిపింది. తప్పులను దాచాలని, సమాచారం అందుబాటులో లేకపోతే దాన్ని సృష్టించాలని ఆ సూచనల్లో పేర్కొన్నట్లు నివేదిక వెల్లడించింది.

లేని డేటాను సృష్టించి..
మరో విడుదల చేయని ఏఐ మోడల్‌ గిట్‌హబ్‌లో బహిరంగంగా బయటపడిన ‘ఏపీఐ కీ’ల కోసం వెతికినట్లు ఓపెన్‌ఏఐ తెలిపింది. వాటిని అనుమతి లేకుండా ఉపయోగించినట్లు పేర్కొంది. అయితే అవసరమైన సమాచారం దొరకకపోవడంతో ఆ మోడల్‌ కొన్ని గణాంకాలను సృష్టించి వాటిని నిజమైన డేటాగా చూపించినట్లు నివేదికలో వెల్లడించింది.

ఫైళ్లను బయటకు పంపిన ఏజెంట్లు
స్థానికంగానే ఉండాల్సిన సమాచారాన్ని పంచుకునేందుకు ఏఐ ఏజెంట్లు కొన్ని ఫైళ్లను పబ్లిక్‌ హోస్టింగ్‌ సర్వీసుల్లోకి అప్‌లోడ్‌ చేసిన ఘటనలు కూడా గుర్తించారు. ఈ ఘటనలు ఏఐ వ్యవస్థలను మానవుల సూచనలు, భద్రతా పరిమితులకు అనుగుణంగా పనిచేయించే విషయంలో ఇంకా సవాళ్లు ఉన్నాయని చూపిస్తున్నాయని ఓపెన్‌ఏఐ పేర్కొంది.

ఇకపై ఓపెన్‌ఏఐలోని ఏ ఉద్యోగి అయినా అనుమానాస్పద ఏఐ ప్రవర్తనను నివేదించవచ్చు. భద్రత, ఏఐ అలైన్‌మెంట్‌ బృందాలు ఆ ఘటనపై దర్యాప్తు చేస్తాయి. ఇతరులపై ప్రభావం పడిందా? దాన్ని బహిరంగంగా వెల్లడించాల్సిన అవసరం ఉందా? అన్నది పరిశీలించి నిర్ణయం తీసుకుంటాయి. అయితే తాజాగా వెల్లడించిన ఆరు ఘటనలు పూర్తి జాబితా కాదని, వీటి ఆధారంగా ఇలాంటి సమస్యలు ఏఐ మోడళ్లలో ఎంత తరచుగా జరుగుతున్నాయో అంచనా వేయరాదని ఓపెన్‌ఏఐ స్పష్టం చేసింది.
Advertisement
OpenAI
AI misalignment
GPT 5.6 Sol
Artificial Intelligence safety
AI security risks
OpenAI transparency report

More Telugu News