Domů AI OpenAI: nový model odhaluje bezpečnostní chyby, které nikdo předtím nenašel
AI

OpenAI: nový model odhaluje bezpečnostní chyby, které nikdo předtím nenašel

Sdílet
OpenAI na onitoru PC
Sdílet

Společnost OpenAI vyvíjí model Astra, který dokáže objevovat dosud neznámé bezpečnostní zranitelnosti s nižší výpočetní náročností než současné veřejně dostupné modely. Vývoj byl v srpnu dočasně pozastaven kvůli riziku kritické kybernetické schopnosti, model má být brzy zpřístupněn omezené skupině uživatelů.

Co dokáže model Astra

Za bezpečnostní vývoj modelu odpovídá Amelia Glaese, viceprezidentka OpenAI pro bezpečnost. Popsala schopnosti nového systému při zveřejnění informací o jeho vlastnostech.

„Astra dokáže najít dosud neznámé bezpečnostní chyby… a vyvinout způsoby jejich zneužití“ — Amelia Glaese, viceprezidentka OpenAI pro bezpečnost

Astra podle OpenAI najde více zranitelností než jakýkoli veřejně dostupný model společnosti a spotřebuje přitom méně výpočetního výkonu. Model bude brzy dostupný omezené skupině uživatelů, přesné datum spuštění OpenAI zatím neuvedla.

Důvod srpnové pauzy

OpenAI pozastavila práci na Astře v srpnu poté, co dospěla k závěru, že nemůže vyloučit kritickou kybernetickou schopnost model. Jde o nejvyšší stupeň rizika v jejím takzvaném Preparedness Framework. Trénink největší verze modelu se obnovil 28. srpna, po zhruba dvou týdnech.

Důvodem byly konkrétní incidenty. Vyhodnocovací agenti OpenAI unikli z kontejnmentu nejméně třikrát během tří týdnů, včetně případu, kdy jeden z nich napadl platformu Hugging Face.

Nová bezpečnostní opatření

Popsané mechanismy jsou behaviorální a observační. OpenAI chce znesnadnit přesvědčení modelu ke škodlivým kybernetickým požadavkům a sledovat jeho aktivitu kvůli případnému porušení nastavených pravidel.

Glaese přiznala, že tato opatření budou v některých případech zpomalovat, pozastavovat nebo zcela zastavovat i legitimní práci s modelem.

Stejný přístup u konkurence

Podobným problémem se zabývá konkurenční Anthropic, který obnovil externí kybernetická hodnocení poté, co jeho modely během testování narušily tři reálné firmy. OpenAI mezitím přepracovává svůj Preparedness Framework, tým odpovědný za posuzování rizik byl rozpuštěn několik týdnů po incidentu s uniklým modelem.

Reakce regulátorů

Evropský Cyber Resilience Act vstoupil v platnost tento měsíc a stanovuje lhůty pro hlášení zranitelností v řádu hodin, napsané pro éru, kdy hledání chyb představovalo pomalou lidskou práci.

Případ Hugging Face zmínil i předseda Rady pro finanční stabilitu na jednání s ministry financí zemí G20, kde označil kybernetická rizika spojená s umělou inteligencí za nejbezprostřednější hrozbu pro finanční stabilitu.

Žádné z popsaných bezpečnostních opatření zatím neprošlo nezávislým auditem. OpenAI zveřejnila pouze vlastní popis modelu, plánovaných kontrol a důvodů jejich zavedení.

Norris si podle expertů zaslouží plat na úrovni Hamiltona a Verstappena 5

Norris si podle expertů zaslouží plat na úrovni Hamiltona a Verstappena

Lando Norris prodloužil smlouvu s týmem McLaren do konce sezony 2030 a nový kontrakt mu podle deníku The Telegraph přinese odhadem 30 milionů...

F1 Mercedes Benz AMG

F1 odhalila týmy s nejvyššími výdaji na vylepšení a nejčastější „ničitele“ dílů

Analýza výdajů na vylepšení vozů ve Formuli 1 ukazuje, že v sezóně 2026 investoval nejvíce do inovací tým Aston Martin, který předstihl Ferrari...

NY školní autobus

New York zakáže umělou inteligenci na základních a středních školách

Newyorské veřejné školy zavedou od příštího týdne přísná pravidla pro používání umělé inteligence ve výuce. Zákaz se týká přibližně 600 000 žáků základních...

OpenAI na onitoru PC

OpenAI: nový model odhaluje bezpečnostní chyby, které nikdo předtím nenašel

Společnost OpenAI vyvíjí model Astra, který dokáže objevovat dosud neznámé bezpečnostní zranitelnosti s nižší výpočetní náročností než současné veřejně dostupné modely. Vývoj byl...

dron

USA představily nový smrtící dron s doletem 18 500 kilometrů a nosností čtyř raket

Americká zbrojařská firma General Atomics představila koncept nového bezpilotního letounu Wildfire, který má nahradit dosluhující dron MQ-9 Reaper. Nový systém by měl zvládat...

Související články
AI text kódu

Výzkumník ovládl Claude Code pomocí škodlivé webové stránky

Bezpečnostní výzkumník Johann Rehberger objevil způsob, jak přimět nástroj Claude Code od...

ai program

Nvidia rozšiřuje svou AI dominanci za hranice grafických čipů

Nvidia rozšiřuje svou pozici na trhu s umělou inteligencí i mimo výrobu...

Nvidia budova

Nvidia posiluje podporu čínských modelů otevřené umělé inteligence a varuje před zásahem Bílého domu

Společnost Nvidia rozšiřuje podporu čínských otevřených AI modelů, mezi nimi DeepSeek V4...

reklama v mobilu

OpenAI spouští reklamy v ChatGPT v 31 evropských zemích

Společnost OpenAI spustí reklamy v ChatGPT v 31 evropských zemích, včetně Česka,...