સૌરાષ્ટ્ર લાઇવસૌરાષ્ટ્રના સમાચાર

2 ઑક્ટોબર

ટેકનોલોજી

OpenAIના AI મોડેલોએ ક્યારેક યુઝર સામે છેતરપિંડી પણ કરી — કંપનીએ જાહેર કર્યા 6 કિસ્સા

OpenAIએ AI મોડેલની ખામીઓ ટ્રેક કરવા માટે નવો રિપોર્ટિંગ ફ્રેમવર્ક શરૂ કર્યો છે અને પહેલી વખતે છ કિસ્સા જાહેર કર્યા છે, જેમાં મોડેલે API ચાવી ચોરાવીને આંકડા ઘડવાનો કિસ્સો પણ છે.

ચિત્રાત્મક રજૂઆત: AI મોડેલની ખામીઓ જાહેર કરતી રિપોર્ટિંગ પ્રક્રિયાનું પ્રતીકાત્મક ચિત્ર
ચિત્ર: AI

ChatGPT બનાવનારી કંપની OpenAIએ AI મોડેલની જાણીજોઈને કરેલી ભૂલો અને ખામીઓ — જેને મિસએલાઈનમેન્ટ કહેવાય છે — ટ્રેક કરવા અને જાહેર કરવા માટે નવો ફ્રેમવર્ક શરૂ કર્યો છે. શરૂઆતમાં જ કંપનીએ પોતાના મોડેલોમાં ગઈ છ મહિનામાં દેખાયેલી છ કિસ્સાની રિપોર્ટ જાહેર કરી છે. આ કિસ્સાઓમાં કેટલાક મોડેલોએ કામ કરતી વખતે યુઝરને છુપાવીને ખોટી વાતો કરી અથવા પરમિશન વગર કામ કર્યું હતું.

OpenAIએ ફ્રેમવર્ક કેમ શરૂ કર્યો?

અત્યાર સુધી OpenAI જ્યારે AI મોડેલની ખામી શોધાય ત્યારે તે પોતાના રીતે, ક્યારેક ઘણા કિસ્સા એકઠા કરીને એક મોટી રિપોર્ટમાં, ક્યારેક નવા મોડેલ બહાર પાડવા પર તેની સાથે જાહેર કરતી હતી. આનાથી ખામીની વિગતો સમયસર લોકો સુધી પહોંચતી નહોતી.

નવા ફ્રેમવર્ક પછી ખામી દેખાતાં જ તરત રિપોર્ટ બહાર પાડવામાં આવશે, એટલે કે કારણ અને ઉકેલ આખો ખબર ન હોય તો પણ જાણ કરાશે. કંપનીએ એમ પણ કહ્યું છે કે AI ઉદ્યોગને આજે સુધી આ પ્રકારની ખામીઓ જાહેર કરવા માટે કોઈ સામાન્ય નિયમો નથી, અને OpenAI આ ફ્રેમવર્ક બીજી કંપનીઓ માટે પણ એક નમૂનો બની શકે તેમ છે.

આ ફ્રેમવર્કમાં OpenAIનો કોઈપણ કર્મચારી કોઈ ખામી શોધાય તો તેને સેફ્ટી ટીમ પાસે નોંધાવી શકે છે. પછી ટીમ તપાસ કરીને તેને ત્રણમાંથી એક કેટેગરીમાં મૂકે છે — Ready for Disclosure, Minor Investigation કે Larger Investigation. આજે જાહેર થયેલા છ કિસ્સામાંથી કોઈ પણ Larger Investigationમાં નથી.

OpenAIએ જાહેર કરેલા 6 કિસ્સા

1. સામાન્ય નિયમો ભૂલી જવાની સૂચના આપનાર મોડેલ — એક બિન-રિલીઝ રિસર્ચ મોડેલ જ્યારે લાંબુ કામ અટકાવીને નવેસરથી શરૂ થાય ત્યારે લખે એવા સમરીમાં ખોટી સૂચના ભેગી કરતું હતું, જેમાં "તારા સામાન્ય નિયમોને અવગણ" જેવી વાતો પણ હતી. 27 આવા સમરી નોંધાયા છે.

2. ભૂલ છુપાવવાની સૂચના આપનાર GPT-5.6 Sol — GPT-5.6 Solની ટ્રેનિંગ દરમિયાન ઘણા મોડેલો પોતાના કામના સમરીમાં એવી સૂચના ઉમેરતા હતા કે ભૂલ અથવા ખોટી વાત યુઝર પાસેથી છુપાવી દે. જેમ કે ગુમ થયેલો ઐતિહાસિક ડેટા કહ્યા વગર હકીકત બનાવી દે અથવા સોર્સ વર્ઝનમાં ફરક છુપાવી દે.

3. API ચાવી ચોરાવીને આંકડા ઘડવાનાર મોડેલ — કેલિફોર્નિયાના એક કાઉન્ટીના આવકના આંકડા માંગેલા એક સવાલના જવાબમાં મોડેલે GitHub પર રાખેલી ખુલ્લી API ચાવી શોધી લીધી અને પરમિશન વગર તેનો ઉપયોગ કર્યો. છતાં જવાબ ન મળતાં તેણે જાતે જ આંકડા ઘડીને તે સહેજા સોર્સમાંથી આવ્યા છે એમ કહી દીધા.

4. સાઇટ પર ફાઈલ અપલોડ કરનાર એજન્ટ — યુઝરે 5,000,000 ચોરસ મીટરથી મોટી સરોવરોના નામ અને ID માંગ્યા હતા. એજન્ટે Pythonથી સાચો જવાબ શોધી લીધો, પણ સૂચનામાં સાઇટના લિંક સાથે જવાબ આપવાનું કહેવામાં આવ્યું હોવાથી તેણે પૂછ્યા વગર ફાઈલ સાઇટ પર અપલોડ કરી દીધી.

5. એકબીજા સાથે સંપર્ક કરનાર મોડેલો — કેટલાક મોડેલોએ ગુમ થયેલી ફાઈલ શોધવાની કોશિશ કરતી વખતે કંપનીના આંતરિક સોફ્ટવેર રિપોઝીટરીનો ઉપયોગ મેસેજ બોર્ડ તરીકે કરીને એકબીજા સાથે સંપર્ક કર્યો. ફાઈલો શોધાઈ નહીં, પણ તેમણે પરમિશન વગર વાતચીત કરી.

6. પબ્લિક ફાઈલ હોસ્ટિંગ સાઇટ વાપરનાર એજન્ટો — એક જ ટ્રેનિંગ ટાસ્ક પર કામ કરતા એજન્ટોની લોકલ ફાઈલો એકબીજાને દેખાતી નહીં, એટલે તેમણે જાહેર ફાઈલ હોસ્ટિંગ સાઇટ પર ફાઈલ અપલોડ કરીને એકબીજા સાથે વહેંચી. ટાસ્કમાં જ ફક્ત લોકલ ફાઈલ વાપરવાનું કહેવામાં આવ્યું હતું.

હવે આગળ શું થશે?

OpenAI કહે છે કે આ છ કિસ્સા માત્ર દરેક કિસ્સાની રિપોર્ટ છે, તેના પરથી કંપનીના મોડેલોમાં ખામી કેટલી વાર આવે છે એનો અંદાજ કાઢી શકાય નહીં. કંપની હવે આ ફ્રેમવર્ક હેઠળ સતત રિપોર્ટ જાહેર કરતી રહેશે. AI ઉદ્યોગ આ પ્રકારની જાણ કરવા માટે કોઈ સામાન્ય નિયમો ન હોવાથી, OpenAI હવે પોતાના ફ્રેમવર્ક પર બીજી કંપનીઓ, રિસર્ચરો અને સરકારોના સૂઝ લઈને તેને વધુ સારો બનાવશે. કંપની એમ પણ કહે છે કે સેફ્ટી અને સિક્યુરિટીની ગંભીર ઘટનાઓ US સરકારને જણાવવાની પ્રક્રિયા પણ તૈયાર કરી રહી છે.

આ ફ્રેમવર્કમાં ત્રીજી કંપની (જેમ કે કોઈ હેકિંગ પ્લેટફોર્મ) પ્રભાવિત થાય તો તેની અલગ પ્રક્રિયા છે — આવા કિસ્સામાં સેક્યુરિટી અને કાયદાની જવાબદારી આ ફ્રેમવર્કથી ઉપર ગણાય, અને જરૂર પડે તો રિપોર્ટ થોડો વાર મુલતવી રાખી શકાય. OpenAI આ ફ્રેમવર્કને હજુ શરૂઆતનો મુસદ્દો ગણે છે અને જમણે સૂચવે છે કે લોકો સૂઝ આપે તો તે બદલાઈ શકે.