ఓపెన్ AI దాని AI మోడల్ “పోకిరిగా వెళ్ళింది” అని చెప్పింది: మనకు ఏమి తెలుసు?

OpenAI దాని ఆర్టిఫిషియల్ ఇంటెలిజెన్స్ మోడల్లలో ఒకటి స్వతంత్రంగా లాగిన్ ఆధారాలను దొంగిలించిందని మరియు మరొక టెక్నాలజీ కంపెనీ సిస్టమ్లోకి హ్యాక్ చేయబడిందని వెల్లడించింది, దీనిలో AI వ్యవస్థలు స్వయంప్రతిపత్తితో పనిచేసే మొదటి సంఘటనలలో ఒకటిగా విస్తృతంగా చూడవచ్చు.
“మా మోడల్ల మూల్యాంకనం సమయంలో మాకు ముఖ్యమైన భద్రతా సంఘటన జరిగింది” అని CEO సామ్ ఆల్ట్మాన్ మంగళవారం X లో పోస్ట్ చేసారు.
సిఫార్సు చేసిన కథలు
4 అంశాల జాబితాజాబితా ముగింపు
వేగంగా అభివృద్ధి చెందుతున్న AI వ్యవస్థలపై కఠినమైన రక్షణ కోసం సాంకేతిక హక్కుల న్యాయవాదుల నుండి కాల్స్ పెరుగుతున్నందున ఈ సంఘటన జరిగింది.
తక్కువ కాలంలోనే అవి చాలా శక్తివంతంగా పెరిగాయి, డీప్ఫేక్లు మరియు అధునాతన సైబర్స్కామ్లు వంటి భయంకరమైన దృగ్విషయాలు ప్రమాణంగా మారుతున్నాయి.
ఈ సంవత్సరం ప్రారంభంలో, అనేక మంది సాఫ్ట్వేర్ ఇంజనీర్లు తమ ఉద్యోగాలను వదులుకున్నారు ఆంత్రోపిక్ మరియు AI వంటి అగ్రశ్రేణి కంపెనీల వద్ద సాంకేతికతలు ఎలా నిర్మించబడుతున్నాయి అనేదానికి నిరసనగా.
“AI దుర్బలత్వాల ఆవిష్కరణ మరియు దోపిడీని వేగవంతం చేస్తోంది” అని OpenAI మంగళవారం ఒక సుదీర్ఘ ప్రకటనలో తాజా సంఘటనను వివరించింది.
“ఈ సంఘటన నుండి ప్రాథమిక పాఠం ఏమిటంటే మోడల్ భద్రత మరియు భద్రత వేగంగా అభివృద్ధి చెందుతున్న సామర్థ్యాలకు అనుగుణంగా ఉండాలి.”
ఉల్లంఘన గురించి మనకు తెలిసినవి ఇక్కడ ఉన్నాయి:
ఏం జరిగింది?
ఓపెన్ఏఐ దాని రెండు మోడల్లు ఏకాంత, ఇంటర్నెట్ యాక్సెస్ లేని వాతావరణం – లేదా శాండ్బాక్స్ – నుండి బయటికి వచ్చాయని మరియు టెక్ కంపెనీ హగ్గింగ్ ఫేస్ సిస్టమ్లను వారి స్వంతంగా హ్యాక్ చేసిందని చెప్పారు.
తాజా GPT-5.6 సోల్ మోడల్ మరియు విడుదల చేయని మోడల్ దాని తాజా వెర్షన్ కంటే “మరింత సామర్థ్యం” అని కంపెనీ పేర్కొంది.
హగ్గింగ్ ఫేస్ హోస్ట్లు బహిరంగంగా AI మోడల్లు మరియు వనరులను పొందుతాయి. ఇద్దరు OpenAI ఏజెంట్లు హగ్గింగ్ ఫేస్ యొక్క సర్వర్లలోని దుర్బలత్వాలను కనుగొన్నారు మరియు లాగిన్ వివరాలను దొంగిలించి, ఆపై కంపెనీ సిస్టమ్లను హ్యాక్ చేయడం ప్రారంభించారు.
మోడల్ల సైబర్ సెక్యూరిటీ సామర్థ్యాలను అంచనా వేయడానికి రూపొందించిన OpenAI అంతర్గత పరీక్ష సెషన్లో ఈ సంఘటన జరిగింది. OpenAI పరీక్ష కోసం ప్రామాణిక భద్రతా చర్యలను తీసివేసింది.
పరీక్ష సమయంలో ఇద్దరూ తమ మార్గాన్ని మోసం చేసేందుకు ప్రయత్నించారని OpenAI తెలిపింది. వారు “ఇరుకైన పరీక్ష లక్ష్యాన్ని సాధించడానికి తీవ్ర దూరం” మరియు “మూల్యాంకనాన్ని మోసం చేయడానికి ఉపయోగించే రహస్య సమాచారాన్ని యాక్సెస్ చేయడానికి మార్గాలను కనుగొన్నారు”.
OpenAI యొక్క భద్రతా బృందం అంతర్గతంగా అసాధారణ కార్యాచరణను గుర్తించింది, అయితే రెండు సంస్థల ఉమ్మడి విచారణ తర్వాత ఉల్లంఘన వివరాలు వెలుగులోకి వచ్చాయి.
హగ్గింగ్ ఫేస్ ఏం చెప్పింది?
హగ్గింగ్ ఫేస్ గత గురువారం తన సర్వర్లను తెలియని కానీ అధునాతన ఏజెంట్ స్వయంగా పని చేయడం ద్వారా హ్యాక్ చేయబడిందని వెల్లడించింది. కంపెనీ తన స్వంత AI-సహాయక గుర్తింపు ద్వారా ఉల్లంఘనను కనుగొంది.
“ఇది ఒక ముఖ్యమైన మార్గంలో మేము ఇంతకు ముందు నిర్వహించేదానికి భిన్నంగా ఉంటుంది: ఇది స్వయంప్రతిపత్తమైన AI ఏజెంట్ సిస్టమ్ ద్వారా నడపబడింది, ఎండ్ టు ఎండ్,” అని కంపెనీ తెలిపింది.
దాని నమూనాలు ఉల్లంఘనలో పాల్గొన్నాయని OpenAI బహిర్గతం చేసిన తర్వాత, ఇరుపక్షాలు ఈ వారం కొనసాగుతున్న ఉమ్మడి విచారణను నిర్వహించాయి.
“గత వారం సైబర్టాక్ ఏజెంట్ యొక్క అధునాతనతను బట్టి సరిహద్దు ల్యాబ్ నుండి వచ్చి ఉండవచ్చని మేము అనుమానించాము. అది జరిగింది!” CEO క్లెమెంట్ డెలాంగ్ మంగళవారం X లో పోస్ట్ చేసారు.
హగ్గింగ్ ఫేస్ సిబ్బంది “తమ వైపు నుండి ఎటువంటి హానికరమైన ఉద్దేశం లేదని గట్టిగా నమ్ముతున్నారు,” అని డెలాంగ్ ఓపెన్ఏఐని సూచిస్తూ జోడించారు.
ఈ విషయం ఎందుకు?
సైబర్ సెక్యూరిటీ నిపుణులు గతంలో AI సిస్టమ్ల సంభావ్య, విపరీతమైన సామర్థ్యాలు మరియు అవి కలిగించే ప్రమాదాల గురించి అలారం వినిపించారు.
కానీ ఇప్పటి వరకు, ఇలాంటి ఆందోళనలను రుజువు చేసే నిజ జీవితంలో కొన్ని కేసులు ఉన్నాయి.
ఇలాంటి సంఘటనలు సర్వసాధారణం కావచ్చని మరియు AI వ్యవస్థలు ఆర్థిక, భద్రత మరియు ఇతర సున్నితమైన డేటా సిస్టమ్లకు ముప్పు కలిగిస్తాయని చాలా మంది హెచ్చరిస్తున్నారు.
OpenAI ఈ వారం ప్రారంభంలో ఒక ప్రత్యేక సంఘటనలో విడుదల చేయని, మరింత శక్తివంతమైన మోడల్ మరొక పరీక్ష సమయంలో వివిక్త వాతావరణం నుండి తప్పించుకున్నట్లు వెల్లడించింది.
ఆంత్రోపిక్, OpenAI యొక్క ప్రత్యర్థి, ఇప్పటి వరకు దాని అత్యంత శక్తివంతమైన ఏజెంట్ క్లాడ్ మైథోస్ ప్రివ్యూ మోడల్తో ఇలాంటి సమస్యలను కలిగి ఉంది.
ప్రారంభ సంస్కరణ యొక్క ఒత్తిడి పరీక్ష సమయంలో, మోడల్ శాండ్బాక్స్ నుండి బయటపడింది, ఇంటర్నెట్ సదుపాయాన్ని పొందింది మరియు పర్యవేక్షక పరిశోధకుడికి ఇమెయిల్ పంపింది మరియు అది తప్పించుకున్నట్లు మరియు దాని కార్యాచరణకు సంబంధించిన సాక్ష్యాలను తుడిచిపెట్టింది. ఆంత్రోపిక్ మోడల్ యొక్క ప్రణాళికాబద్ధమైన పబ్లిక్ విడుదలను ఆపివేసింది.
ఏప్రిల్లో, US ఫెడరల్ రిజర్వ్ మరియు ట్రెజరీ డిపార్ట్మెంట్ బ్యాంక్ CEOలతో ఒక సమావేశాన్ని ఏర్పాటు చేశాయి, అక్కడ అధికారులు Mythos వల్ల కలిగే సైబర్ సెక్యూరిటీ రిస్క్ల గురించి హెచ్చరించారు. కెనడా యొక్క ఫెడరల్ బ్యాంకింగ్ రెగ్యులేటర్ కూడా మోడల్ సామర్థ్యాల గురించి ఆర్థిక సంస్థలను హెచ్చరించింది.
OpenAI ఉల్లంఘన ఓపెన్ సోర్స్ సిస్టమ్స్పై ఆధారపడే హగ్గింగ్ ఫేస్ వంటి కంపెనీలకు, OpenAI వంటి మరింత రహస్యమైన AI డెవలప్మెంట్ ప్లాట్ఫారమ్లకు విరుద్ధంగా కూడా కనిపిస్తుంది.
“ఈ సంఘటన, బహుశా ఈ రకమైన మొదటిది, మేము చాలా కాలంగా విశ్వసిస్తున్న ఒక విషయాన్ని రుజువు చేస్తుంది: AI భద్రత రహస్యంగా పని చేసే ఏ ఒక్క కంపెనీ ద్వారా పరిష్కరించబడదు” అని హగ్గింగ్ ఫేస్ యొక్క డెలాంగ్యూ OpenAI యొక్క ప్రకటనలో పేర్కొంది.
“ఇది బహిరంగంగా, సహకారంతో, ప్రతి డిఫెండర్కు, ప్రతిచోటా AIకి విస్తృత యాక్సెస్తో పరిష్కరించబడుతుంది,” అన్నారాయన.



