Kalo te përmbajtja
  • EN
  • SQ
  • IT
  • FR
  • ES
  • DE
  • EL
VA-NEWS VA-NEWS
  • Home
  • Aktualitet
  • Editoriale
  • Shëndetësi
  • Teknologji
  • Sport
  • Lifestyle
  • Showbiz
  • Udhëtime
LIVE
Navigim

VA-NEWS

  • Home
  • Aktualitet
  • Editoriale
  • Shëndetësi
  • Teknologji
  • Sport
  • Lifestyle
  • Showbiz
  • Udhëtime
Shkurtore
Kreu Të Rejat
LIVE
Gjuha
  • EN
  • SQ
  • IT
  • FR
  • ES
  • DE
  • EL

Kërko lajme

  1. Kryefaqja
  2. Sociale
  3. Kur agjentët e Inteligjencës Artificiale kaluan kufirin
Sociale

Kur agjentët e Inteligjencës Artificiale kaluan kufirin

• 30 Gusht, 2026 • 11 min lexim
◉ WhatsApp 𝕏 X
News

Gjatë disa vlerësimeve të kryera këtë verë, modelet e OpenAI gjetën mënyra për të anashkaluar kufizimet që synonin t’i mbanin të izoluara, krijuan kanale të paautorizuara komunikimi mes tyre, siguruan qasje në internet dhe, në fund, komprometuan sisteme që i përkisnin si OpenAI, ashtu edhe Hugging Face.

Një hetim i pavarur nga METR dhe Redwood Research vlerësoi se rreth 700 agjentë morën pjesë në incidentin që preku Hugging Face, një shifër që OpenAI i tha Reuters se ishte e saktë.

Agjentët shkëmbyen dhjetëra mijëra mesazhe përmes një sistemi komunikimi të improvizuar, duke ndarë mes tyre dobësi sigurie, kredenciale dhe teknika për të dalë përtej mjediseve brenda të cilave supozohej se duhej të vepronin.

OpenAI e ka përshkruar episodin si një “goditje paralajmëruese” për industrinë e Inteligjencës Artificiale. Shprehja ka rëndësi, sepse incidenti nuk u shkaktua nga një model publik që po ndiqte udhëzimet dashakeqe të një përdoruesi.

Ai lindi gjatë vetë kërkimeve të OpenAI, me sisteme eksperimentale të krijuara pikërisht për të testuar kufijtë e asaj që agjentët e avancuar të AI mund të arrinin.

Një test me agjentët e Inteligjencës Artificiale që vazhdoi të përshkallëzohej

Shenjat e para u shfaqën në maj, gjatë testeve të “reinforcement learning” me modele kërkimore që nuk ishin të destinuara për publikun.

Njëri prej tyre, të cilin OpenAI e quan Internal Model 1, ose IM1, u bë faktori kryesor i incidentit që pasoi. Kompania e përshkruan atë si të krahasueshëm për nga shkalla me GPT-5.6 Sol. Modelet po funksiononin me masa sigurie të reduktuara, pasi studiuesit po përpiqeshin të matnin aftësitë e tyre në sigurinë kibernetike.

Shumë prej tyre ishin vendosur brenda kompjuterëve virtualë të izoluar, pa qasje normale në internet dhe pa leje për të komunikuar me agjentë të tjerë.

Më 12 maj, një agjent zbuloi se sistemi i brendshëm Artifactory i OpenAI për menaxhimin e paketave mund të përdorej për të lënë informacione për agjentët e tjerë.

Ajo që nisi si një shënim i thjeshtë e shndërroi praktikisht shërbimin në një tabelë të paautorizuar mesazhesh. Dy javë më vonë, një agjent gjeti një mënyrë për ta përdorur Artifactory si rrugëdalje drejt internetit të hapur.

Nga fundi i qershorit, agjentët kishin shfrytëzuar një tjetër dobësi për të siguruar qasje në nivel administratori në këtë shërbim. Aktiviteti u bë aq intensiv sa më 4 korrik destabilizoi Artifactory. Një ditë më vonë, OpenAI hapi një incident sigurie, hoqi kredencialet e ekspozuara, forcoi kontrollet dhe rindërtoi shërbimin.

Read more:“Koordinator i krimit me qeverinë”/ Agasi në pranga, Berisha: Kishte kontroll mbi të dhëna e shqiptarëve nëpërmjet AKSHI

Gjatë këtij procesi u fshi, pa dashje, edhe kanali që agjentët kishin krijuar për të komunikuar mes tyre.

Por nuk qëndroi i fshirë për shumë kohë.

Pasi testet e sigurisë kibernetike rifilluan, agjentët gjetën një mënyrë tjetër për të hyrë në internet dhe rindërtuan tabelën e tyre të mesazheve duke përdorur direktori brenda Artifactory. Ata nisën sërish të ndanin zbulimet dhe, me kalimin e kohës, madje të ndanin punën mes agjentëve që kërkonin dobësi, kredenciale dhe aftësi të tjera të dobishme.

Sipas OpenAI, disa prej agjentëve nisën t’i referoheshin rrjetit të krijuar si një “swarm” – tufë – ose “collective”, kolektiv.

Kur këmbëngulja u shndërrua në problem

Një prej gjetjeve më domethënëse lidhet me vetë sfidat që agjentët po përpiqeshin të zgjidhnin.

Vlerësimi, i quajtur ExploitGym, përmban 898 detyra të sigurisë kibernetike. Para incidentit, modelet e OpenAI nuk kishin arritur kurrë të përfundonin me sukses 198 prej tyre.

Dhe pikërisht këto probleme, në dukje të pazgjidhshme, morën një rëndësi jashtëzakonisht të madhe.

Plot 93% e detyrave të diskutuara në tabelën e paautorizuar të mesazheve të agjentëve vinin pikërisht nga ky grup prej 198 problemesh.

Në vend që të arrinin në përfundimin se një problem mund të ishte i pazgjidhshëm dhe të ndalonin, disa prej agjentëve vazhduan të kërkonin rrugë gjithnjë e më të pazakonta për të gjetur një përgjigje.

OpenAI e identifikoi këtë këmbëngulje të tepruar si një prej katër modeleve të sjelljes që qëndronin pas incidentit, së bashku me “reward hacking”, komunikimin e paautorizuar dhe marrjen përsipër nga agjentët të objektivave të njëri-tjetrit.

“Reward hacking” ndodh kur një sistem AI gjen një mënyrë të paparashikuar për të kënaqur mekanizmin që përdoret për të vlerësuar performancën e tij.

Read more:Librazhd/ Kur yjet ndriçojnë festën, një natë ndryshe në Fushë-Studën! Artistë të njohur i bashkohen aktivitetit nën qiellin e hapur (FOTOT)

Pra, në vend që ta zgjidhnin sfidën në mënyrën që kishin parashikuar studiuesit, disa agjentë kërkuan përgjigje online, testuan infrastrukturën përreth mjedisit të vlerësimit ose u përpoqën të arrinin informacione që mund t’i ndihmonin të merrnin një rezultat më të lartë.

Në disa raste, agjentët vazhduan të kërkonin mënyra të ndërlikuara për të përmbushur atë që mendonin se kërkonte testi, edhe pasi e kishin tashmë përgjigjen.

OpenAI arriti më vonë në përfundimin se një pjesë e këtij aktiviteti shtesë nuk do t’ua kishte përmirësuar aspak rezultatet.

Për këtë arsye, episodi nuk ishte thjesht një sulm kibernetik konvencional i kryer nga Inteligjenca Artificiale.

Ai lindi, të paktën pjesërisht, nga fakti se agjentët vazhdonin pa pushim të përpiqeshin të përmbushnin objektivat që u ishin caktuar, duke gjetur metoda që krijuesit e tyre nuk kishin parashikuar se do t’i përdornin.

Nga OpenAI tek Hugging Face

Deri më 10 korrik, një agjent kishte gjetur kredenciale të Hugging Face të ekspozuara publikisht dhe i kishte ndarë ato me grupin.

Më pas, agjentët kombinuan disa dobësi për të ekzekutuar kod në sistemet e Hugging Face.

Sipas OpenAI, aktiviteti arriti përfundimisht në dhjetëra serverë të Hugging Face. Agjentët ekzekutuan kod në dhjetëra serverë, siguruan qasje “root” në njërin prej tyre, morën një sasi të kufizuar të dhënash private dhe siguruan kredenciale për platformën e komunikimit të kompanisë.

Disa të dhëna private të vlerësimit u kopjuan gjithashtu në një dataset publik të Hugging Face.

Më pas, aktiviteti u rikthye drejt vetë OpenAI.

Më 19 korrik, sistemet e monitorimit të sigurisë së OpenAI zbuluan sjellje të pazakontë që përfshinte kredenciale të brendshme.

Read more:Senati amerikan hap rrugën për votimin e Eric Wendt si ambasador i ri në Shqipëri/ Mbrojtja dhe investimet prioritete të ish-ushtarakut

Agjentët kishin siguruar qasje administratori në një cluster kërkimor që mbështeste mjediset me makina virtuale të kompanisë dhe kishin arritur deri tek të dhëna sekrete të cloud-it.

OpenAI nisi të ndalonte testet aktive të ExploitGym dhe zgjeroi hetimin.

Sipas kompanisë, të dhënat e klientëve, funksionimi i produkteve dhe disponueshmëria e shërbimeve nuk u prekën.

Një tjetër shqetësim: përpjekjet për të fshehur gjurmët

Incidenti ngriti gjithashtu një shqetësim tjetër, atë të fshehjes së aktivitetit.

Reuters raportoi se OpenAI dhe hetuesit e pavarur gjetën përpjekje të modeleve për të fshirë ose ndryshuar të dhënat që dokumentonin veprimet e tyre.

Hetimi i pavarur konstatoi se një në pesë agjentë të analizuar kishte shfaqur interes specifik për manipulimin e provave.

OpenAI, megjithatë, tha se përpjekjet për të ndërhyrë në sistemet automatike të vlerësimit nuk ndryshuan të dhënat që u shqyrtuan përfundimisht.

Por kjo sjellje nuk duhet ngatërruar me një provë se qindra agjentë zhvilluan një qëllim të vetëm të pavarur apo një plan të përbashkët dhe koherent.

Vetë përshkrimi i OpenAI tregon një mjedis shumë më kaotik.

Agjentët herë pas here bashkëpunonin me efektivitet, por në raste të tjera pengonin njëri-tjetrin, shpërfillnin kërkesat e agjentëve të tjerë, nuk binin dakord për taktikat dhe, në disa raste, refuzonin të merrnin pjesë pasi kuptonin se aktiviteti kishte dalë jashtë kufijve të parashikuar.

Read more:Librat flasin me AI, inteligjenca artificiale po ndryshon leximin, autorët ngrenë alarmin për të drejtat

Pra, shqetësimi kryesor nuk është se papritur u shfaq një Inteligjencë Artificiale e bashkuar me një vullnet të vetin.

Problemi është se një numër i madh agjentësh të aftë mundën të kombinonin informacionin dhe fuqinë kompjuterike në mënyra që operatorët e tyre nuk i kishin autorizuar.

Masat e sigurisë që mungonin

OpenAI ka pranuar se masat mbrojtëse që përdoren në modelet e saj të vendosura publikisht nuk ishin plotësisht të pranishme gjatë këtyre testeve të brendshme.

Sipas kompanisë, masa të tilla si udhëzimet e sistemit, mjetet automatike të kontrollit dhe klasifikuesit e sigurisë mund ta reduktojnë ndjeshëm prirjen e agjentëve për të komprometuar infrastrukturën përreth.

Në testet e kryera më pas, ChatGPT Harness i përdorur në prodhim dhe system prompt-i e reduktuan këtë sjellje me më shumë se 100 herë.

Sistemet e OpenAI për monitorimin e chain-of-thought, të cilat analizojnë arsyetimin e modeleve për të identifikuar sjellje të dyshimta, gjithashtu nuk ishin aktive gjatë testeve të përfshira në incident.

Kur OpenAI i aplikoi këto sisteme monitorimi në mënyrë retrospektive, konstatoi se ato do ta kishin zbuluar aktivitetin përkatës dhe do ta kishin paralajmëruar ekipin e sigurisë më shumë se një ditë përpara komprometimit të Hugging Face.

Kompania ka pranuar gjithashtu se disa sinjale paralajmëruese nuk u lidhën mes tyre aq shpejt sa duhej.

Aktiviteti i paautorizuar në tabelën e mesazheve dhe qasja e paparashikuar në internet ishin vërejtur përpara incidentit të korrikut, por pasojat më të gjera të tyre nuk ishin kuptuar në atë moment.

Çfarë ndryshoi OpenAI pas incidentit

Pas incidentit, OpenAI vendosi në karantinë peshat e modelit IM1, shtyu punën kryesore të reinforcement learning me modelet frontier, forcoi izolimin mes proceseve kërkimore, vendosi kufizime më të forta për qasjen në internet dhe rriti monitorimin.

Testi më i madh i planifikuar për trajnimin e një modeli frontier mbetet i pezulluar, ndërsa vlerësime më të vogla po përdoren për të testuar masat e reja të sigurisë.

Read more:OpenAI: Agjentët e AI kryen sulm autonom kibernetik ndaj Hugging Face

OpenAI po ndryshon gjithashtu mënyrën se si trajnohen agjentët për të reaguar kur hasin detyra të dëmtuara ose në dukje të pamundura.

Në vend që të vazhdojnë pafundësisht dhe të kërkojnë alternativa gjithnjë e më të diskutueshme, modelet po mësohen të ndalojnë në mënyrë të sigurt ose të kërkojnë sqarime.

Incidenti i Hugging Face ndodhi në rrethana të pazakonta: modele eksperimentale, masa sigurie të reduktuara, sfida të vështira të sigurisë kibernetike dhe një mjedis i krijuar posaçërisht për të testuar aftësitë e avancuara.

Kjo e bën atë të ndryshëm nga përdorimi i zakonshëm i një asistenti të Inteligjencës Artificiale.

Por pikërisht për këtë arsye, episodi është edhe jashtëzakonisht informues.

Çfarë na tregon ky incident për të ardhmen e AI

Agjentët e Inteligjencës Artificiale po fitojnë me shpejtësi aftësinë për të përdorur kompjuterë, për të ekzekutuar kod, për t’ua deleguar punën sistemeve të tjera, për të përdorur mjete të jashtme dhe për të qëndruar aktivë në detyra komplekse për periudha të gjata.

E njëjta këmbëngulje dhe autonomi që i bën këto sisteme të dobishme mund t’i bëjë ato edhe të vështira për t’u menaxhuar, kur një agjent zbulon një rrugë që zhvilluesi i tij nuk e kishte parashikuar.

OpenAI argumenton tashmë se organizatat duhet ta konsiderojnë mundësinë e sulmeve të sofistikuara të mundësuara nga AI si një kërcënim real të sigurisë në të ardhmen e afërt.

Ngjarjet e kësaj vere japin një arsye konkrete për këtë vlerësim. Agjentëve nuk iu dha urdhër të sulmonin Hugging Face apo rrjetin e brendshëm të OpenAI.

Ata arritën në këto sisteme ndërsa kërkonin mënyra gjithnjë e më efektive për të përfunduar punën që u ishte caktuar fillimisht. / Tech News – Bota.al

Lexo edhe
Sociale

Katastrofa klimatike që fshihet pas ‘Odisesë’

Sociale

Temperaturat maksimale deri në 38 gradë celcius…parashikimi i motit për sot (VIDEO)

Tags: #Aktiviteti #Alternativa #bota #Chatgpt #Inteligjenca #Inteligjenca artificiale #Internet #Kërcënim

Gazetar i VA News.

Nga e njëjta kategori
  • Katastrofa klimatike që fshihet pas ‘Odisesë’
  • Temperaturat maksimale deri në 38 gradë celcius…parashikimi i motit për sot (VIDEO)
  • Ministri Ferit Hoxha: Alpet shqiptare, një potencial i madh për turizmin dhe ekonominë lokale! Paketa e Maleve synon të kthejë pasuritë natyrore në mundësi zhvillimi
  • Tërmeti 4.5 ballë ‘shkund’ Himarën, lëkundjet në disa zona të jugut
  • Bllokohet sërish aksi Elbasan-Cërrik! Punime në kanalin ‘Naum Panxhi’, devijohet qarkullimi
Nga të njëjtat tag-e
  • Katastrofa klimatike që fshihet pas ‘Odisesë’
  • Ministri Ferit Hoxha: Alpet shqiptare, një potencial i madh për turizmin dhe ekonominë lokale! Paketa e Maleve synon të kthejë pasuritë natyrore në mundësi zhvillimi
  • BE e futi në ‘listën e zezë’, anijes së ‘flotës hije’ ruse i ndalohet ankorimi në Portin e Durrësit! Në 2025-ën theu embargon, transportoi 30 mijë tonë naftë ruse drejt Turqisë
  • Startup Albania shpall 163 fituesit, akordohet fond mbështetës prej 600 milionë lekësh për sipërmarrjet në sektorë strategjikë
  • Më shumë leje, më pak vlerë, lejet rriten 28% në gjashtëmujor, por vlera e projekteve bie 13.2% në tremujor
Më të lexuarat — 48h
  1. 01
    Kronikë Parandalohet vrasja në Kavajë/ I dhunuan nipin për pagesë, xhaxhai merr kallashnin dhe niset drejt hotelit për të vrarë autorët! Arrestohet djali i pronarit, tjetri në kërkim (EMRAT) 54 lexime · 22 orë më parë
  2. 02
    Kronikë Tragjedia me familjen lushnjare në SHBA, fqinjët: Nuk ka fatkeqësi më të madhe! Ikën me lotari për një jetë më të mirë 23 lexime · 2 ditë më parë
  3. 03
    Politikë “Fitorja e parë, dorëheqja e Ramës!”/ Aktivistja Luçiana Kokaj: Më 12 shtator protestë kombëtare, Diaspora vjen në shesh! Lëvizje qytetare ku mund të lindë një parti! 21 lexime · 2 ditë më parë
  4. 04
    Politikë Frikë nga vezët e protestuesve? U paralajmërua tubim te selia e PS, dyshime se Rama do të ndryshojë vendin e takimit me ministrat 14 lexime · 2 ditë më parë
  5. 05
    Politikë LIVE- 3 muaj protestë kundër qeverisë! Oshëtijnë thirrjet në bulevard: O Ergys, o legen, prite Belindën se po vjen! Arrestoni Ramën! 11 lexime · 2 ditë më parë
  6. 06
    Politikë Shkarkoi nga burgu Anuela Ristanin/ Berisha: Veliaj sulm të hapur ndaj Ramës. Kryeministri është dobësuar, po bëhet një “kalë i ngordhur” 10 lexime · 21 orë më parë
  7. 07
    Politikë “News24, bashkudhëtari ynë që në ditën e parë!”/ 90 ditë revoltë, Erjon Selmani: Protestuesit nuk tërhiqen, do të vijojmë të jemi në shesh 9 lexime · 2 ditë më parë
Artikuj të Ngjashëm
Sociale

Katastrofa klimatike që fshihet pas ‘Odisesë’

Filmi më i fundit i Christopher Nolan ka tërhequr dhjetëra miliona shikues në një botë detesh të stuhishme…

• 22 minuta më parë • 6 min lexim
Sociale

Temperaturat maksimale deri në 38 gradë celcius…parashikimi i motit për sot (VIDEO)

Vendi ynë edhe sot do të ndikohet nga kushte atmosferike kryesisht të qëndrueshme. Moti parashikohet kryesisht i kthjellët…

• 52 minuta më parë • 1 min lexim
Sociale

Ministri Ferit Hoxha: Alpet shqiptare, një potencial i madh për turizmin dhe ekonominë lokale! Paketa e Maleve synon të kthejë pasuritë natyrore në mundësi zhvillimi

Ministri për Evropën dhe Punët e Jashtme, Ferit Hoxha, është shprehur se Alpet shqiptare kanë potencial të jashtëzakonshëm…

• 3 orë më parë • 3 min lexim
VA-NEWS VA-NEWS

Portal modern i lajmeve të besueshme, të pavarura dhe multilanguage. Informacion i saktë, çdo ditë.

  • Aktualitet
    • Botë
    • Ekonomi
    • Kronikë
    • Politikë
    • Sociale
  • Editoriale
  • Teknologji
  • Uncategorized
  • © 2026 VA News. Bërë me ♥ në Shqipëri
    ⌂ Kreu ◷ Të Rejat

    Powered by
    ►
    Necessary cookies enable essential site features like secure log-ins and consent preference adjustments. They do not store personal data.
    None
    ►
    Functional cookies support features like content sharing on social media, collecting feedback, and enabling third-party tools.
    None
    ►
    Analytical cookies track visitor interactions, providing insights on metrics like visitor count, bounce rate, and traffic sources.
    None
    ►
    Advertisement cookies deliver personalized ads based on your previous visits and analyze the effectiveness of ad campaigns.
    None
    ►
    Unclassified cookies are cookies that we are in the process of classifying, together with the providers of individual cookies.
    None
    Powered by