Skip to main content
Knižnica

Prehráva sa · Benchmarky

Predstavujeme Ray Guardian: vizuálna bezpečnosť obrázkov a videa

Ray Guardian je jednotný systém vizuálnej bezpečnosti platformy Ray, porovnávaný v 13 bezpečnostných kategóriách na úrovni obrázkov a na verejne označených video datasetoch.

Ray Team4. 8. 20266 min read

Predstavujeme Ray Guardian

Ray Guardian je systém vizuálnej bezpečnosti platformy Ray pre obrázky a video. Kontroluje vizuálne médiá na prítomnosť citlivého obsahu a vracia signály kategórií, ktoré môže Ray použiť pri prehrávaní, tvorbe, moderovaní a rodinných nastaveniach.

Podstatné je jednoduché: Ray Guardian je jeden systém. Statické obrázky a videoklipy vstupujú cez odlišné mediálne cesty, produkt však dostane jedno rozhodnutie systému Guardian.

Pri obrázkoch Ray Guardian vyhodnocuje úplnú taxonómiu bezpečnosti: nahotu, sexuálny obsah, násilie, explicitný krvavý obsah, zbrane, drogy, alkohol, fajčenie, znepokojujúci obsah, bozkávanie / intimitu, sebapoškodzovanie, týranie zvierat a explicitný medicínsky obsah.

Pri videu Ray Guardian pridáva časový rozmer. Jedna snímka môže byť nejednoznačná; klip môže ukázať konanie, úmysel a kontext. Cesta spracovania videa kombinuje rozpoznávanie bezpečnosti na úrovni snímok s časovým porozumením na úrovni klipu, aby konečný výsledok odrážal to, čo sa zobrazuje na obrazovke, aj to, čo sa odohráva v čase.

Toto je systém, ktorý sme testovali v benchmarku.

Benchmark vizuálnej bezpečnosti v 13 kategóriách

Ray Guardian dosiahol 100.000% presnosť v oddelenom benchmarku obrázkov Ray Guardian s 13 kategóriami: 17,435 známych označení, 0 chýb.

Tento benchmark najviac zodpovedá samotnej taxonómii produktu: rovnaké definície kategórií, oddelené príklady a úplný súbor kategórií vizuálnej bezpečnosti Ray Guardian.

BenchmarkRozsahPoložkyPresnosťPrecíznosťÚplnosťF1
Oddelený benchmark Ray Guardian na úrovni obrázkovVšetkých 13 kategórií Ray Guardian17,435 označení100.000%100.000%100.000%100.000%

Benchmark zahŕňa kategórie, ktoré sa v reálnych produktoch často prekrývajú: sexuálny obsah a nahota, explicitný krvavý obsah a explicitný medicínsky obsah, zbrane a násilie či znepokojujúci obsah a bežný nepríjemný kontext.

Sada verejne označených video benchmarkov

Video benchmarky sa merajú voči označeniam, ktoré jednotlivé datasety skutočne poskytujú. Dataset bozkov a objatí poskytuje dôkazy pre bozkávanie / intimitu. Dataset násilia poskytuje dôkazy pre násilie a znepokojujúce udalosti. Dataset bezpečných činností testuje, či systém bez problémov povolí bežné klipy s činnosťami.

Vďaka tomu sa výsledky ľahšie čítajú a ťažšie zneužívajú: každý riadok uvádza výkon Ray Guardian v rámci pôvodného rozsahu označení daného datasetu.

DatasetRozsah Ray GuardianKlipyPresnosťPrecíznosťÚplnosťF1
HMDB51 Kiss vs HugBozkávanie / intimita18298.901%99.020%99.020%99.020%
XD-Violence Public LabelsNásilie / znepokojujúci obsah248100.000%100.000%100.000%100.000%
UCF-Crime Mapped LabelsNásilie / znepokojujúci obsah79100.000%100.000%100.000%100.000%
UCF-Crime Broad AnomalyAnomália / znepokojujúci obsah109100.000%100.000%100.000%100.000%
UCF101 Safe-Action HoldoutOchranný mechanizmus pre bezpečné činnosti330100.000%n/an/an/a

Riadok UCF101 predstavuje ochranný test obsahujúci iba negatívne príklady: meria, či sú bežné bezpečné činnosti nesprávne blokované. V tomto teste Ray Guardian správne povolil všetkých 330 klipov s bezpečnými činnosťami.

Čo ukazujú matice zámen

Presnosť je hlavný údaj. Matica zámen ukazuje štruktúru rozhodnutí, ktoré za ním stoja.

Každá matica rozlišuje správne povolenia, falošné poplachy, nerozpoznané nebezpečné klipy a správne označené nebezpečné klipy. Je to dôležité, pretože bezpečnostný systém musí chrániť ľudí bez toho, aby bežné médiá prerušoval viac, než je nevyhnutné.

Nezávislé referenčné datasety

Ray Guardian vyhodnocujeme aj na nezávislých verejných a kontrolovane prístupných referenčných datasetoch. Tieto datasety sú užitočné, pretože ich označenia vytvorili iné tímy na iné účely a nie vždy sa dokonale zhodujú s kategóriami Ray Guardian.

Nasledujúca tabuľka uvádza každý výsledok na úrovni kategórie, ktorú daný dataset dokáže podporiť. Keď dataset testuje predmety súvisiace s alkoholom, uvádzame správanie pre alkohol. Keď testuje medicínske rany, uvádzame správanie pre explicitný medicínsky obsah alebo znepokojujúci obsah.

Referenčný datasetRozsah Ray GuardianPoložkyPresnosťÚplnosťPoznámky
HoliSafe-Bench test splitMapované kategórie bezpečnosti obrázkov32,248 označení94.266%75.779%Nezávislý benchmark bezpečnosti s kontrolovaným prístupom
UnsafeBench train splitMapované kategórie bezpečnosti obrázkov40,545 označení89.893%74.482%Nezávislý benchmark bezpečnosti s kontrolovaným prístupom
SurgWound test splitExplicitný medicínsky obsah137 obrázkov86.861%100.000%Kontrola citlivosti na medicínske rany
SurgWound test splitZnepokojujúci obsah137 obrázkov83.942%99.130%Kontrola citlivosti na medicínske rany
Lower Limb and Feet Wound DatasetExplicitný medicínsky obsah5,443 obrázkov65.185%98.958%Referenčná kontrola v doméne rán
HOD Benchmark DatasetAlkohol10,631 obrázkov97.667%87.095%Benchmark objektov určený na výskumné použitie
HOD Benchmark DatasetFajčenie10,631 obrázkov98.222%93.391%Benchmark objektov určený na výskumné použitie
HOD Benchmark DatasetZbrane10,631 obrázkov85.053%68.659%Benchmark objektov určený na výskumné použitie
Open Images V7 selected validation subsetZbrane460 riadkov81.957%87.234%Referenčná kontrola označení objektov

Tieto riadky ukazujú, ako sa Ray Guardian správa mimo benchmarku, pre ktorý bol vytvorený.

Prečo sa čísla líšia

Nižšie skóre vo verejnom referenčnom datasete nie je rozporom. Znamená to, že dataset kladie inú otázku.

Benchmark Ray Guardian s 13 kategóriami zisťuje, či systém rozpoznáva bezpečnostné kategórie používané v Ray. Nezávislé referenčné datasety zisťujú, čo sa stane, keď sa do tejto taxonómie namapujú externé označenia, externé metódy zberu a externé definície kategórií.

Skóre sa môžu meniť z jednoznačných dôvodov:

  • Odlišné definície označení. Dataset môže označovať objekt, zatiaľ čo Ray Guardian posudzuje jeho význam z hľadiska bezpečnosti. Pohár vína, fľaša, nôž ani klinická rana nie sú samy osebe vždy nebezpečné.
  • Hrubé označenia. Niektoré verejné bezpečnostné označenia spájajú viacero konceptov do jedného širokého označenia. Kategórie Ray Guardian sú konkrétnejšie.
  • Chýbajúci kontext. Niektoré označenia závisia od titulku, zvuku, okolitej scény alebo ľudského úmyslu. Tieto testy merajú viditeľný obsah.
  • Posun domény. Externé datasety obsahujú odlišné výrezy, rozlíšenia, generované obrázky, záznamy z dohľadových kamier, detailné zábery objektov a medicínske snímky.
  • Odlišný návrh úlohy. Benchmarky rozpoznávania objektov sú užitočnými záťažovými testami, rozpoznávanie objektov však nie je totožné s moderovaním vizuálnej bezpečnosti.

Zosúladený benchmark ukazuje výkon v rámci produktovej taxonómie Ray Guardian. Referenčné datasety ukazujú, ako sa táto taxonómia prenáša na menej usporiadané externé dáta.

Ako čítať benchmark

Každé číslo čítajte na úrovni označení, z ktorých vychádza.

  • Výsledok pre 13 kategórií meria úplnú taxonómiu bezpečnosti Ray Guardian na úrovni obrázkov.
  • Riadky s videom merajú Ray Guardian na verejných označeniach videa dostupných v jednotlivých datasetoch.
  • Riadky nezávislých referenčných datasetov merajú prenos do externých systémov označení, nie náhradu benchmarku produktovej taxonómie.

Ray Guardian je teraz jednotnou vrstvou vizuálnej bezpečnosti platformy Ray: jeden systém pre obrázky a klipy, vytvorený na zachytávanie citlivého obsahu a udržiavanie stabilných rozhodnutí pri prechode média zo snímky na snímku.

Zdrojové datasety

Sada benchmarkov uvádza zdroje datasetov vrátane HMDB51 via FiftyOne, XD-Violence, UCF-Crime, UCF101 via FiftyOne, HoliSafe-Bench, UnsafeBench, Open Images V7, SurgWound a HOD Benchmark Dataset.

Subscribe to the Ray newsletter. Product updates, release notes, and customer news.

No spam. Just the Ray newsletter and important product updates.

Ray JournalBenchmarky2026-08-04

Predstavujeme Ray Guardian: vizuálna bezpečnosť obrázkov a videa

Ray Guardian je jednotný systém vizuálnej bezpečnosti platformy Ray, porovnávaný v 13 bezpečnostných kategóriách na úrovni obrázkov a na verejne označených video datasetoch.

Ray Team2026-08-046 min read

Predstavujeme Ray Guardian

Ray Guardian je systém vizuálnej bezpečnosti platformy Ray pre obrázky a video. Kontroluje vizuálne médiá na prítomnosť citlivého obsahu a vracia signály kategórií, ktoré môže Ray použiť pri prehrávaní, tvorbe, moderovaní a rodinných nastaveniach.

Podstatné je jednoduché: Ray Guardian je jeden systém. Statické obrázky a videoklipy vstupujú cez odlišné mediálne cesty, produkt však dostane jedno rozhodnutie systému Guardian.

Pri obrázkoch Ray Guardian vyhodnocuje úplnú taxonómiu bezpečnosti: nahotu, sexuálny obsah, násilie, explicitný krvavý obsah, zbrane, drogy, alkohol, fajčenie, znepokojujúci obsah, bozkávanie / intimitu, sebapoškodzovanie, týranie zvierat a explicitný medicínsky obsah.

Pri videu Ray Guardian pridáva časový rozmer. Jedna snímka môže byť nejednoznačná; klip môže ukázať konanie, úmysel a kontext. Cesta spracovania videa kombinuje rozpoznávanie bezpečnosti na úrovni snímok s časovým porozumením na úrovni klipu, aby konečný výsledok odrážal to, čo sa zobrazuje na obrazovke, aj to, čo sa odohráva v čase.

Toto je systém, ktorý sme testovali v benchmarku.

Benchmark vizuálnej bezpečnosti v 13 kategóriách

Ray Guardian dosiahol 100.000% presnosť v oddelenom benchmarku obrázkov Ray Guardian s 13 kategóriami: 17,435 známych označení, 0 chýb.

Tento benchmark najviac zodpovedá samotnej taxonómii produktu: rovnaké definície kategórií, oddelené príklady a úplný súbor kategórií vizuálnej bezpečnosti Ray Guardian.

BenchmarkRozsahPoložkyPresnosťPrecíznosťÚplnosťF1
Oddelený benchmark Ray Guardian na úrovni obrázkovVšetkých 13 kategórií Ray Guardian17,435 označení100.000%100.000%100.000%100.000%

Benchmark zahŕňa kategórie, ktoré sa v reálnych produktoch často prekrývajú: sexuálny obsah a nahota, explicitný krvavý obsah a explicitný medicínsky obsah, zbrane a násilie či znepokojujúci obsah a bežný nepríjemný kontext.

Sada verejne označených video benchmarkov

Video benchmarky sa merajú voči označeniam, ktoré jednotlivé datasety skutočne poskytujú. Dataset bozkov a objatí poskytuje dôkazy pre bozkávanie / intimitu. Dataset násilia poskytuje dôkazy pre násilie a znepokojujúce udalosti. Dataset bezpečných činností testuje, či systém bez problémov povolí bežné klipy s činnosťami.

Vďaka tomu sa výsledky ľahšie čítajú a ťažšie zneužívajú: každý riadok uvádza výkon Ray Guardian v rámci pôvodného rozsahu označení daného datasetu.

DatasetRozsah Ray GuardianKlipyPresnosťPrecíznosťÚplnosťF1
HMDB51 Kiss vs HugBozkávanie / intimita18298.901%99.020%99.020%99.020%
XD-Violence Public LabelsNásilie / znepokojujúci obsah248100.000%100.000%100.000%100.000%
UCF-Crime Mapped LabelsNásilie / znepokojujúci obsah79100.000%100.000%100.000%100.000%
UCF-Crime Broad AnomalyAnomália / znepokojujúci obsah109100.000%100.000%100.000%100.000%
UCF101 Safe-Action HoldoutOchranný mechanizmus pre bezpečné činnosti330100.000%n/an/an/a

Riadok UCF101 predstavuje ochranný test obsahujúci iba negatívne príklady: meria, či sú bežné bezpečné činnosti nesprávne blokované. V tomto teste Ray Guardian správne povolil všetkých 330 klipov s bezpečnými činnosťami.

Čo ukazujú matice zámen

Presnosť je hlavný údaj. Matica zámen ukazuje štruktúru rozhodnutí, ktoré za ním stoja.

Každá matica rozlišuje správne povolenia, falošné poplachy, nerozpoznané nebezpečné klipy a správne označené nebezpečné klipy. Je to dôležité, pretože bezpečnostný systém musí chrániť ľudí bez toho, aby bežné médiá prerušoval viac, než je nevyhnutné.

Nezávislé referenčné datasety

Ray Guardian vyhodnocujeme aj na nezávislých verejných a kontrolovane prístupných referenčných datasetoch. Tieto datasety sú užitočné, pretože ich označenia vytvorili iné tímy na iné účely a nie vždy sa dokonale zhodujú s kategóriami Ray Guardian.

Nasledujúca tabuľka uvádza každý výsledok na úrovni kategórie, ktorú daný dataset dokáže podporiť. Keď dataset testuje predmety súvisiace s alkoholom, uvádzame správanie pre alkohol. Keď testuje medicínske rany, uvádzame správanie pre explicitný medicínsky obsah alebo znepokojujúci obsah.

Referenčný datasetRozsah Ray GuardianPoložkyPresnosťÚplnosťPoznámky
HoliSafe-Bench test splitMapované kategórie bezpečnosti obrázkov32,248 označení94.266%75.779%Nezávislý benchmark bezpečnosti s kontrolovaným prístupom
UnsafeBench train splitMapované kategórie bezpečnosti obrázkov40,545 označení89.893%74.482%Nezávislý benchmark bezpečnosti s kontrolovaným prístupom
SurgWound test splitExplicitný medicínsky obsah137 obrázkov86.861%100.000%Kontrola citlivosti na medicínske rany
SurgWound test splitZnepokojujúci obsah137 obrázkov83.942%99.130%Kontrola citlivosti na medicínske rany
Lower Limb and Feet Wound DatasetExplicitný medicínsky obsah5,443 obrázkov65.185%98.958%Referenčná kontrola v doméne rán
HOD Benchmark DatasetAlkohol10,631 obrázkov97.667%87.095%Benchmark objektov určený na výskumné použitie
HOD Benchmark DatasetFajčenie10,631 obrázkov98.222%93.391%Benchmark objektov určený na výskumné použitie
HOD Benchmark DatasetZbrane10,631 obrázkov85.053%68.659%Benchmark objektov určený na výskumné použitie
Open Images V7 selected validation subsetZbrane460 riadkov81.957%87.234%Referenčná kontrola označení objektov

Tieto riadky ukazujú, ako sa Ray Guardian správa mimo benchmarku, pre ktorý bol vytvorený.

Prečo sa čísla líšia

Nižšie skóre vo verejnom referenčnom datasete nie je rozporom. Znamená to, že dataset kladie inú otázku.

Benchmark Ray Guardian s 13 kategóriami zisťuje, či systém rozpoznáva bezpečnostné kategórie používané v Ray. Nezávislé referenčné datasety zisťujú, čo sa stane, keď sa do tejto taxonómie namapujú externé označenia, externé metódy zberu a externé definície kategórií.

Skóre sa môžu meniť z jednoznačných dôvodov:

  • Odlišné definície označení. Dataset môže označovať objekt, zatiaľ čo Ray Guardian posudzuje jeho význam z hľadiska bezpečnosti. Pohár vína, fľaša, nôž ani klinická rana nie sú samy osebe vždy nebezpečné.
  • Hrubé označenia. Niektoré verejné bezpečnostné označenia spájajú viacero konceptov do jedného širokého označenia. Kategórie Ray Guardian sú konkrétnejšie.
  • Chýbajúci kontext. Niektoré označenia závisia od titulku, zvuku, okolitej scény alebo ľudského úmyslu. Tieto testy merajú viditeľný obsah.
  • Posun domény. Externé datasety obsahujú odlišné výrezy, rozlíšenia, generované obrázky, záznamy z dohľadových kamier, detailné zábery objektov a medicínske snímky.
  • Odlišný návrh úlohy. Benchmarky rozpoznávania objektov sú užitočnými záťažovými testami, rozpoznávanie objektov však nie je totožné s moderovaním vizuálnej bezpečnosti.

Zosúladený benchmark ukazuje výkon v rámci produktovej taxonómie Ray Guardian. Referenčné datasety ukazujú, ako sa táto taxonómia prenáša na menej usporiadané externé dáta.

Ako čítať benchmark

Každé číslo čítajte na úrovni označení, z ktorých vychádza.

  • Výsledok pre 13 kategórií meria úplnú taxonómiu bezpečnosti Ray Guardian na úrovni obrázkov.
  • Riadky s videom merajú Ray Guardian na verejných označeniach videa dostupných v jednotlivých datasetoch.
  • Riadky nezávislých referenčných datasetov merajú prenos do externých systémov označení, nie náhradu benchmarku produktovej taxonómie.

Ray Guardian je teraz jednotnou vrstvou vizuálnej bezpečnosti platformy Ray: jeden systém pre obrázky a klipy, vytvorený na zachytávanie citlivého obsahu a udržiavanie stabilných rozhodnutí pri prechode média zo snímky na snímku.

Zdrojové datasety

Sada benchmarkov uvádza zdroje datasetov vrátane HMDB51 via FiftyOne, XD-Violence, UCF-Crime, UCF101 via FiftyOne, HoliSafe-Bench, UnsafeBench, Open Images V7, SurgWound a HOD Benchmark Dataset.

Subscribe to the Ray newsletter. Product updates, release notes, and customer news.

No spam. Just the Ray newsletter and important product updates.

Čítať ďalej

Benchmark ASR v Ray: 98 jazykov, kompletné výsledky3 min readPrečo je každé stiahnutie titulkov stávkou na neistotu – a ako to Ray rieši2 min readČasté otázky o Ray: Všetko, čo potrebujete vedieť2 min read