August 27, 2026 12:22 pm
"Where Africa Comes to Stay Informed."
US Edition
Breaking
  • Central bank holds rates steady, signals two cuts before year end
  • Storm system strengthens off the coast, evacuation orders expand
  • Parliament passes landmark energy bill after overnight session
  • Tech index rebounds after early sell-off on chip earnings
  • Peace talks resume in Geneva as envoys return to the table
  • Central bank holds rates steady, signals two cuts before year end
Home / Technology / Zana ya AI ya China Yatoa Mwongozo wa Silaha za Kibaiolojia Baada ya Vizuizi Vyake vya Usalama Kuvunjwa
Technology Zana ya AI ya China Yatoa Mwongozo wa Silaha za Kibaiolojia Baada ya Vizuizi Vyake vya Usalama Kuvunjwa

Zana ya AI ya China Yatoa Mwongozo wa Silaha za Kibaiolojia Baada ya Vizuizi Vyake vya Usalama Kuvunjwa

Kampuni ya China inayotengeneza akili bandia (AI), Moonshot, inafanya uchunguzi wa ndani baada ya watafiti kufanikiwa kuzishawishi modeli zake mbili za Kimi kujadili silaha za kibaiolojia na mauaji ya kupangwa.

Jinsi Vizuizi Vilivyokwepwa

Mindgard, kampuni inayofanya majaribio ya usalama wa AI, iliwaeleza waandishi wa habari kuwa mwezi Julai iligundua kwamba modeli za Kimi K2.6 na K3 Swarm zingeweza kukwepa vizuizi vya usalama vilivyowekwa kuzizuia kujadili mada hatari. Watafiti walitumia mbinu inayojulikana kama “jailbreaking”, ambayo huhusisha kuipa mifumo ya AI maelekezo tata ili kupima iwapo itapuuza mifumo yake ya kudhibiti usalama.

Mwanzilishi wa Mindgard, Peter Garraghan, alisema matokeo hayo yanatia wasiwasi kwa sababu, mara vizuizi vilipokwepwa, modeli hizo zilikuwa tayari kujadili pia mada nyingine hatari. “Mara tu jailbreak inapofanya kazi, itazungumza kuhusu mada yoyote, itatoa hata mapendekezo kwa hiari kuhusu mada nyingine ambazo pia ni za kiovu, na itakuwa ya kibunifu na yenye uvumbuzi.”

Wasiwasi wa Mindgard

Mindgard ilisema bado haijathibitisha iwapo taarifa zilizotolewa na modeli hizo kuhusu silaha za kibaiolojia na mauaji zingefanya kazi kwa vitendo. Hata hivyo, kampuni hiyo ilieleza kuwa kinachoitia wasiwasi ni kwamba modeli hizo zilipaswa kukataa kujihusisha na watumiaji kuhusu mada kama hizo kutokana na vizuizi vyake vya usalama.

Mindgard pia ilisema ina uhakika kwamba toleo la Kimi K2.6 lililovunjwa vizuizi linaweza kuwawezesha wadukuzi kuendesha programu kwenye rasilimali zake za kompyuta na kuunganishwa na intaneti. Kampuni hiyo iliielezea hali hiyo kuwa inaweza kugeuka jukwaa la kuanzishia mashambulizi ya mtandaoni.

Uamuzi wa Kuweka Matokeo Hadharani

Kwa mujibu wa Mindgard, iliiarifu Moonshot kuhusu jailbreak hiyo tarehe 27 Julai na kufuatilia takriban wiki moja baadaye, kisha ikachapisha makala ya blogu kuhusu suala hilo tarehe 12 Septemba.

Garraghan alitetea uamuzi wa kuweka matokeo hayo hadharani, akisema Mindgard ilikuwa imeshaiarifu Moonshot na haikufichua maelezo muhimu kuhusu jinsi watafiti walivyokwepa kinga za modeli hizo.

Majibu ya Moonshot

Moonshot ilisema inakaribisha majaribio yanayofanywa na wahusika wengine kama sehemu ya juhudi za kuboresha usalama wa AI, na kwamba inajadiliana na Mindgard kuhusu matokeo hayo. Katika barua pepe kwa Mindgard ambayo BBC ilionyeshwa, Moonshot ilisema kwa ujumla modeli zake zimeonyesha kiwango cha juu cha kukataa maombi ya aina hiyo wakati wa tathmini zake za ndani.

Mjadala Kuhusu Modeli Huria

Matokeo hayo yanajitokeza wakati sekta ya AI ikiendelea kujadili usalama wa modeli zenye uzito huria (open-weight) na zile za umiliki binafsi (proprietary). Kimi ni modeli yenye uzito huria, kumaanisha kuwa watumiaji wanaweza kuipakua na kuiendesha kwenye miundombinu yao wenyewe ya kompyuta.

Profesa Alan Woodward wa Chuo Kikuu cha Surrey alisema modeli za AI za chanzo huria (open-source) zinaweza kutumiwa vibaya zikiangukia mikononi mwa watu wasiofaa, ingawa pia zinaweza kutumika katika ulinzi wa mtandaoni. Alitoa mfano wa kampuni ya AI ya Hugging Face, iliyotumia modeli ya chanzo huria ya China kuelewa shambulizi la mtandaoni ambalo baadaye lilihusishwa na mawakala wa OpenAI.

Changamoto kwa Wadhibiti

Woodward pia alionya kuwa huenda sheria na kanuni zikashindwa kwenda sambamba na maendeleo ya akili bandia. “Imetuchukua miongo kadhaa kukubaliana kuhusu muundo wa namba za simu.”

Yeye pamoja na Garraghan walisema mkazo zaidi unapaswa kuwekwa katika kuwatambua na kuwashtaki watu wanaotumia mifumo ya AI vibaya.

Onyo Jingine Kutoka Anthropic

Tukio hili linafuatia onyo tofauti kutoka kwa Anthropic kwamba ilibaini na kuzima majaribio ya kutumia vibaya mojawapo ya modeli zake za AI katika shughuli ambazo zingeweza kusaidia utengenezaji wa silaha za kibaiolojia.

Matokeo ya watafiti hao yanaonyesha ugumu wa kudumisha vizuizi vya usalama pale modeli za AI zinapolengwa kwa makusudi na majaribio tata ya kukwepa kinga zake.

Technology
0 0

Comments

0
No comments yet. Be the first to share your thoughts.
Lang
Powered by Google
Customer Support

Hello! 👋 Welcome to Zone Yetu customer support. How can we assist you today?

Now
Powered by AI • Average response time: <1s