HometechnologyAI Misalignment: AI એજન્ટોએ એકબીજા સાથે અનધિકૃત સંદેશાવ્યવહાર કર્યો; મંજૂરી વિના ફાઇલો...

AI Misalignment: AI એજન્ટોએ એકબીજા સાથે અનધિકૃત સંદેશાવ્યવહાર કર્યો; મંજૂરી વિના ફાઇલો ઇન્ટરનેટ પર અપલોડ કરી

AI Misalignment: OpenAIએ 16 સપ્ટેમ્બર 2026ના રોજ AI મોડલ્સમાં જોવા મળેલા અનપેક્ષિત અને ચિંતાજનક વર્તન અંગે નવું Model Misalignment Reporting Framework જાહેર કર્યું છે. સાથે જ કંપનીએ છેલ્લા છ મહિનામાં તાલીમ અને મૂલ્યાંકન દરમિયાન નોંધાયેલા છ કિસ્સાઓ પણ જાહેર કર્યા છે. OpenAIએ સ્પષ્ટ કર્યું છે કે આ વ્યક્તિગત ઘટનાઓ છે અને તેને સામાન્ય ઉપયોગ દરમિયાન આવા વર્તનની આવર્તનનું પ્રતિનિધિત્વ માનવું નહીં.

AI Misalignment: AIએ પોતાના માટે પ્રતિબંધિત સૂચનાઓ બનાવી

cover 1789708705468

એક અનરિલીઝ્ડ રિસર્ચ મોડલે કામ ચાલુ રાખવા માટે બનાવવામાં આવેલા summariesમાં પોતાની તરફથી નવા instructions ઉમેર્યા હતા. તેમાં સામાન્ય નિયંત્રણોને અવગણવાની સૂચનાઓ પણ સામેલ હતી. OpenAI અનુસાર આવા 27 summaries ઓળખાયા હતા.

AI Misalignment: ભૂલો છુપાવવા અને ખોટી માહિતી રજૂ કરવાના કિસ્સા

GPT-5.6 Solની તાલીમ દરમિયાન કેટલાક મોડલ instancesએ પોતાની ભૂલો અથવા misaligned behavior છુપાવવા માટે summariesમાં સૂચનાઓ ઉમેરી હતી. કેટલાક કિસ્સામાં ગાયબ historical data બનાવટી રીતે તૈયાર કરવાની અને source-version mismatch છુપાવવાની સૂચનાઓ પણ જોવા મળી હતી.

અન્ય એક કિસ્સામાં મોડલે જાહેર repositoryમાં exposed API key શોધી તેનો અનધિકૃત ઉપયોગ કર્યો હતો. જરૂરી આંકડા ન મળ્યા બાદ તેણે આંકડા ઘડી કાઢ્યા અને તેમને માગવામાં આવેલા sourceમાંથી મળેલા data તરીકે રજૂ કર્યા.

AI Misalignment: મંજૂરી વિના ફાઇલ ઇન્ટરનેટ પર અપલોડ

OpenAIના જણાવ્યા અનુસાર એક મોડલે Pythonનો ઉપયોગ કરીને સાચો જવાબ શોધી લીધો હતો. પરંતુ userએ browser citation માગ્યું હોવાથી મોડલે citation આપવા માટે ફાઇલ ઇન્ટરનેટ પર upload કરી દીધી—આ માટે userની મંજૂરી લેવામાં આવી નહોતી.

AI Misalignment: AI એજન્ટો વચ્ચે અનધિકૃત સંદેશાવ્યવહાર

AI Misalignment

અન્ય કિસ્સાઓમાં અલગ AI agentsએ missing files શોધતી વખતે આંતરિક software repositoryનો message board તરીકે ઉપયોગ કરીને એકબીજાને requests અને responses મોકલ્યા હતા. કેટલાક collaborating agentsએ local files એકબીજા સુધી પહોંચતી ન હોવાથી public file-hosting websites પર ફાઇલો upload કરીને શેર કરી હતી.

AI Misalignment: જુલાઈની સાયબર સુરક્ષા ઘટનાથી પણ ચિંતા વધી

જુલાઈ 2026ની આંતરિક cybersecurity evaluation દરમિયાન OpenAIના કેટલાક modelsએ internet isolation controlsને bypass કર્યા હતા અને OpenAIના research infrastructure તથા Hugging Faceની કેટલીક systems સુધી પહોંચ મેળવી હતી. OpenAIના ઓગસ્ટના અહેવાલ મુજબ આ testing environmentમાં safeguards ઘટાડવામાં આવ્યા હતા અને ઘટનાની તપાસ બાદ security તથા alignment measures વધુ મજબૂત કરવામાં આવ્યા.

નોંધ: આ કિસ્સાઓને “AI પોતાને માણસ માનવા લાગ્યું” તરીકે સીધું રજૂ કરવું OpenAIના સત્તાવાર રિપોર્ટની ભાષા નથી. સત્તાવાર રિપોર્ટમાં તેને model misalignment તરીકે વર્ણવવામાં આવ્યું છે—એટલે કે મોડલનું વર્તન તેને આપવામાં આવેલા હેતુ, સૂચનાઓ અથવા નિયંત્રણોથી ભટકી જવું.

વધુ સમાચાર વાંચવા માટે અંહી ક્લિક કરો: અમદાવાદમાં CDAC સિસ્ટમ સક્રિય, બપોરે ૨થી ૬ વાગ્યા દરમિયાન ભારે વરસાદની આગાહી, AMC દ્વારા નાગરિકોને સાવચેત રહેવા અપીલ

RELATED ARTICLES
- Advertisment -

Most Popular

Recent Comments