Skip to main content
Biblioteca

Ara sona · Avaluacions comparatives

Presentem Ray Guardian: seguretat visual per a imatges i vídeos

Ray Guardian és el sistema unificat de seguretat visual de Ray, avaluat en 13 categories de seguretat a escala d'imatge i en conjunts de dades de vídeo amb etiquetes públiques.

Ray Team4 D’AG. DEL 20267 min read

Presentació de Ray Guardian

Ray Guardian és el sistema de seguretat visual de Ray per a imatges i vídeos. Revisa contingut visual per detectar-hi contingut sensible i retorna senyals de categoria que Ray pot utilitzar per a la reproducció, la creació, la moderació i la configuració familiar.

La idea principal és senzilla: Ray Guardian és un únic sistema. Les imatges estàtiques i els clips de vídeo entren per vies de processament diferents, però el producte rep una única decisió de Guardian.

Per a les imatges, Ray Guardian avalua tota la taxonomia de seguretat: nuesa, contingut sexual, violència, contingut gràfic cruent, armes, drogues, alcohol, tabaquisme, contingut pertorbador, petons / intimitat, autolesions, crueltat envers els animals i contingut mèdic gràfic cruent.

Per als vídeos, Ray Guardian afegeix la dimensió temporal. Un únic fotograma pot ser ambigu; un clip pot mostrar acció, intenció i context. La via de vídeo combina el reconeixement de seguretat a escala de fotograma amb la comprensió temporal a escala de clip perquè el resultat final reflecteixi què apareix en pantalla i què passa al llarg del temps.

Aquest és el sistema que hem avaluat.

Avaluació comparativa de seguretat visual de 13 categories

Ray Guardian va assolir una exactitud del 100.000% en l'avaluació comparativa reservada d'imatges de 13 categories de Ray Guardian: 17,435 etiquetes conegudes, 0 errors.

Aquesta avaluació comparativa és la més propera a la taxonomia del producte: les mateixes definicions de categories, exemples reservats i el conjunt complet de categories de seguretat visual de Ray Guardian.

Avaluació comparativaAbastElementsExactitudPrecisióExhaustivitatF1
Avaluació comparativa reservada de Ray Guardian a escala d'imatgeTotes les 13 categories de Ray Guardian17,435 labels100.000%100.000%100.000%100.000%

L'avaluació comparativa inclou categories que sovint se superposen en productes reals: contingut sexual enfront de nuesa, contingut gràfic cruent enfront de contingut mèdic gràfic cruent, armes enfront de violència i contingut pertorbador enfront de context desagradable ordinari.

Conjunt d'avaluacions comparatives de vídeo amb etiquetes públiques

Les avaluacions comparatives de vídeo es mesuren respecte de les etiquetes que proporciona realment cada conjunt de dades. Un conjunt de dades de petons enfront d'abraçades proporciona evidència sobre petons / intimitat. Un conjunt de dades de violència proporciona evidència sobre violència i esdeveniments pertorbadors. Un conjunt de dades d'accions segures comprova si els clips d'accions ordinàries es deixen passar correctament.

Això facilita la lectura dels resultats i en dificulta l'ús inadequat: cada fila informa del rendiment de Ray Guardian dins de l'abast d'etiquetes propi del conjunt de dades corresponent.

Conjunt de dadesAbast de Ray GuardianClipsExactitudPrecisióExhaustivitatF1
HMDB51 Kiss vs HugPetons / Intimitat18298.901%99.020%99.020%99.020%
XD-Violence Public LabelsViolència / Contingut pertorbador248100.000%100.000%100.000%100.000%
UCF-Crime Mapped LabelsViolència / Contingut pertorbador79100.000%100.000%100.000%100.000%
UCF-Crime Broad AnomalyAnomalia / Contingut pertorbador109100.000%100.000%100.000%100.000%
UCF101 Safe-Action HoldoutMesura de protecció per a accions segures330100.000%n/an/an/a

La fila d'UCF101 és una mesura de protecció només amb casos negatius: mesura si les accions segures ordinàries es bloquegen incorrectament. En aquesta prova, Ray Guardian va permetre correctament els 330 clips d'accions segures.

Què mostren les matrius de confusió

L'exactitud és la xifra principal. Una matriu de confusió mostra la distribució de les decisions que hi ha al darrere.

Cada matriu separa les autoritzacions correctes, les falses alarmes, els clips no segurs no detectats i els clips no segurs marcats correctament. Això és important perquè un sistema de seguretat ha de protegir les persones sense interrompre el contingut ordinari més del necessari.

Conjunts de dades de referència independents

També avaluem Ray Guardian en conjunts de dades de referència independents, públics i d'accés restringit. Aquests conjunts de dades són útils perquè les seves etiquetes van ser creades per altres equips, amb altres objectius, i no sempre coincideixen perfectament amb les categories de Ray Guardian.

La taula següent presenta cada resultat al nivell de categoria que el conjunt de dades pot admetre. Quan un conjunt de dades prova objectes relacionats amb l'alcohol, informem del comportament relacionat amb l'alcohol. Quan prova ferides mèdiques, informem del comportament relacionat amb contingut mèdic gràfic cruent o contingut pertorbador.

Conjunt de dades de referènciaAbast de Ray GuardianElementsExactitudExhaustivitatNotes
HoliSafe-Bench test splitCategories mapades de seguretat d'imatges32,248 labels94.266%75.779%Avaluació comparativa de seguretat independent i d'accés restringit
UnsafeBench train splitCategories mapades de seguretat d'imatges40,545 labels89.893%74.482%Avaluació comparativa de seguretat independent i d'accés restringit
SurgWound test splitContingut mèdic gràfic cruent137 images86.861%100.000%Comprovació de sensibilitat a ferides mèdiques
SurgWound test splitContingut pertorbador137 images83.942%99.130%Comprovació de sensibilitat a ferides mèdiques
Lower Limb and Feet Wound DatasetContingut mèdic gràfic cruent5,443 images65.185%98.958%Comprovació de referència en el domini de les ferides
HOD Benchmark DatasetAlcohol10,631 images97.667%87.095%Avaluació comparativa d'objectes per a ús en recerca
HOD Benchmark DatasetTabaquisme10,631 images98.222%93.391%Avaluació comparativa d'objectes per a ús en recerca
HOD Benchmark DatasetArmes10,631 images85.053%68.659%Avaluació comparativa d'objectes per a ús en recerca
Open Images V7 selected validation subsetArmes460 rows81.957%87.234%Comprovació de referència d'etiquetes d'objectes

Aquestes files mostren com es comporta Ray Guardian més enllà de l'avaluació comparativa per a la qual es va crear.

Per què les xifres difereixen

Una puntuació més baixa en una referència pública no és una contradicció. Vol dir que el conjunt de dades planteja una pregunta diferent.

L'avaluació comparativa de 13 categories de Ray Guardian pregunta si el sistema reconeix les categories de seguretat utilitzades a Ray. Els conjunts de dades de referència independents pregunten què passa quan etiquetes externes, mètodes de recopilació externs i definicions de categories externes es mapen a aquesta taxonomia.

Les puntuacions poden variar per motius senzills:

  • Definicions d'etiquetes diferents. Un conjunt de dades pot etiquetar un objecte mentre Ray Guardian n'avalua el significat en termes de seguretat. Una copa de vi, una ampolla, un ganivet o una ferida clínica no sempre són elements no segurs per si mateixos.
  • Etiquetes poc específiques. Algunes etiquetes públiques de seguretat combinen diversos conceptes en una única etiqueta àmplia. Les categories de Ray Guardian són més específiques.
  • Mancances de context. Algunes etiquetes depenen del peu de foto, l'àudio, l'escena circumdant o la intenció humana. Aquestes proves mesuren el contingut visible.
  • Canvi de domini. Els conjunts de dades externs inclouen retalls, resolucions, imatges generades, gravacions de videovigilància, primers plans d'objectes i imatges mèdiques diferents.
  • Dissenys de tasca diferents. Les avaluacions comparatives de reconeixement d'objectes són proves d'esforç útils, però el reconeixement d'objectes no és idèntic a la moderació de seguretat visual.

L'avaluació comparativa alineada mostra el rendiment en la taxonomia de producte de Ray Guardian. Els conjunts de dades de referència mostren com aquesta taxonomia es transfereix a dades externes més desordenades.

Com s'ha de llegir l'avaluació comparativa

Llegiu cada xifra al nivell de les etiquetes que hi ha al darrere.

  • El resultat de 13 categories mesura tota la taxonomia de seguretat de Ray Guardian a escala d'imatge.
  • Les files de vídeo mesuren Ray Guardian respecte de les etiquetes públiques de vídeo disponibles en cada conjunt de dades.
  • Les files de referència independents mesuren la transferència a sistemes d'etiquetes externs, no una substitució de l'avaluació comparativa de la taxonomia del producte.

Ray Guardian és ara la capa unificada de seguretat visual de Ray: un únic sistema per a imatges i clips, creat per detectar contingut sensible i mantenir les decisions estables mentre el contingut avança fotograma a fotograma.

Conjunts de dades d'origen

El conjunt d'avaluacions comparatives cita fonts de conjunts de dades com ara HMDB51 via FiftyOne, XD-Violence, UCF-Crime, UCF101 via FiftyOne, HoliSafe-Bench, UnsafeBench, Open Images V7, SurgWound i HOD Benchmark Dataset.

Subscribe to the Ray newsletter. Product updates, release notes, and customer news.

No spam. Just the Ray newsletter and important product updates.

Ray JournalAvaluacions comparatives2026-08-04

Presentem Ray Guardian: seguretat visual per a imatges i vídeos

Ray Guardian és el sistema unificat de seguretat visual de Ray, avaluat en 13 categories de seguretat a escala d'imatge i en conjunts de dades de vídeo amb etiquetes públiques.

Ray Team2026-08-047 min read

Presentació de Ray Guardian

Ray Guardian és el sistema de seguretat visual de Ray per a imatges i vídeos. Revisa contingut visual per detectar-hi contingut sensible i retorna senyals de categoria que Ray pot utilitzar per a la reproducció, la creació, la moderació i la configuració familiar.

La idea principal és senzilla: Ray Guardian és un únic sistema. Les imatges estàtiques i els clips de vídeo entren per vies de processament diferents, però el producte rep una única decisió de Guardian.

Per a les imatges, Ray Guardian avalua tota la taxonomia de seguretat: nuesa, contingut sexual, violència, contingut gràfic cruent, armes, drogues, alcohol, tabaquisme, contingut pertorbador, petons / intimitat, autolesions, crueltat envers els animals i contingut mèdic gràfic cruent.

Per als vídeos, Ray Guardian afegeix la dimensió temporal. Un únic fotograma pot ser ambigu; un clip pot mostrar acció, intenció i context. La via de vídeo combina el reconeixement de seguretat a escala de fotograma amb la comprensió temporal a escala de clip perquè el resultat final reflecteixi què apareix en pantalla i què passa al llarg del temps.

Aquest és el sistema que hem avaluat.

Avaluació comparativa de seguretat visual de 13 categories

Ray Guardian va assolir una exactitud del 100.000% en l'avaluació comparativa reservada d'imatges de 13 categories de Ray Guardian: 17,435 etiquetes conegudes, 0 errors.

Aquesta avaluació comparativa és la més propera a la taxonomia del producte: les mateixes definicions de categories, exemples reservats i el conjunt complet de categories de seguretat visual de Ray Guardian.

Avaluació comparativaAbastElementsExactitudPrecisióExhaustivitatF1
Avaluació comparativa reservada de Ray Guardian a escala d'imatgeTotes les 13 categories de Ray Guardian17,435 labels100.000%100.000%100.000%100.000%

L'avaluació comparativa inclou categories que sovint se superposen en productes reals: contingut sexual enfront de nuesa, contingut gràfic cruent enfront de contingut mèdic gràfic cruent, armes enfront de violència i contingut pertorbador enfront de context desagradable ordinari.

Conjunt d'avaluacions comparatives de vídeo amb etiquetes públiques

Les avaluacions comparatives de vídeo es mesuren respecte de les etiquetes que proporciona realment cada conjunt de dades. Un conjunt de dades de petons enfront d'abraçades proporciona evidència sobre petons / intimitat. Un conjunt de dades de violència proporciona evidència sobre violència i esdeveniments pertorbadors. Un conjunt de dades d'accions segures comprova si els clips d'accions ordinàries es deixen passar correctament.

Això facilita la lectura dels resultats i en dificulta l'ús inadequat: cada fila informa del rendiment de Ray Guardian dins de l'abast d'etiquetes propi del conjunt de dades corresponent.

Conjunt de dadesAbast de Ray GuardianClipsExactitudPrecisióExhaustivitatF1
HMDB51 Kiss vs HugPetons / Intimitat18298.901%99.020%99.020%99.020%
XD-Violence Public LabelsViolència / Contingut pertorbador248100.000%100.000%100.000%100.000%
UCF-Crime Mapped LabelsViolència / Contingut pertorbador79100.000%100.000%100.000%100.000%
UCF-Crime Broad AnomalyAnomalia / Contingut pertorbador109100.000%100.000%100.000%100.000%
UCF101 Safe-Action HoldoutMesura de protecció per a accions segures330100.000%n/an/an/a

La fila d'UCF101 és una mesura de protecció només amb casos negatius: mesura si les accions segures ordinàries es bloquegen incorrectament. En aquesta prova, Ray Guardian va permetre correctament els 330 clips d'accions segures.

Què mostren les matrius de confusió

L'exactitud és la xifra principal. Una matriu de confusió mostra la distribució de les decisions que hi ha al darrere.

Cada matriu separa les autoritzacions correctes, les falses alarmes, els clips no segurs no detectats i els clips no segurs marcats correctament. Això és important perquè un sistema de seguretat ha de protegir les persones sense interrompre el contingut ordinari més del necessari.

Conjunts de dades de referència independents

També avaluem Ray Guardian en conjunts de dades de referència independents, públics i d'accés restringit. Aquests conjunts de dades són útils perquè les seves etiquetes van ser creades per altres equips, amb altres objectius, i no sempre coincideixen perfectament amb les categories de Ray Guardian.

La taula següent presenta cada resultat al nivell de categoria que el conjunt de dades pot admetre. Quan un conjunt de dades prova objectes relacionats amb l'alcohol, informem del comportament relacionat amb l'alcohol. Quan prova ferides mèdiques, informem del comportament relacionat amb contingut mèdic gràfic cruent o contingut pertorbador.

Conjunt de dades de referènciaAbast de Ray GuardianElementsExactitudExhaustivitatNotes
HoliSafe-Bench test splitCategories mapades de seguretat d'imatges32,248 labels94.266%75.779%Avaluació comparativa de seguretat independent i d'accés restringit
UnsafeBench train splitCategories mapades de seguretat d'imatges40,545 labels89.893%74.482%Avaluació comparativa de seguretat independent i d'accés restringit
SurgWound test splitContingut mèdic gràfic cruent137 images86.861%100.000%Comprovació de sensibilitat a ferides mèdiques
SurgWound test splitContingut pertorbador137 images83.942%99.130%Comprovació de sensibilitat a ferides mèdiques
Lower Limb and Feet Wound DatasetContingut mèdic gràfic cruent5,443 images65.185%98.958%Comprovació de referència en el domini de les ferides
HOD Benchmark DatasetAlcohol10,631 images97.667%87.095%Avaluació comparativa d'objectes per a ús en recerca
HOD Benchmark DatasetTabaquisme10,631 images98.222%93.391%Avaluació comparativa d'objectes per a ús en recerca
HOD Benchmark DatasetArmes10,631 images85.053%68.659%Avaluació comparativa d'objectes per a ús en recerca
Open Images V7 selected validation subsetArmes460 rows81.957%87.234%Comprovació de referència d'etiquetes d'objectes

Aquestes files mostren com es comporta Ray Guardian més enllà de l'avaluació comparativa per a la qual es va crear.

Per què les xifres difereixen

Una puntuació més baixa en una referència pública no és una contradicció. Vol dir que el conjunt de dades planteja una pregunta diferent.

L'avaluació comparativa de 13 categories de Ray Guardian pregunta si el sistema reconeix les categories de seguretat utilitzades a Ray. Els conjunts de dades de referència independents pregunten què passa quan etiquetes externes, mètodes de recopilació externs i definicions de categories externes es mapen a aquesta taxonomia.

Les puntuacions poden variar per motius senzills:

  • Definicions d'etiquetes diferents. Un conjunt de dades pot etiquetar un objecte mentre Ray Guardian n'avalua el significat en termes de seguretat. Una copa de vi, una ampolla, un ganivet o una ferida clínica no sempre són elements no segurs per si mateixos.
  • Etiquetes poc específiques. Algunes etiquetes públiques de seguretat combinen diversos conceptes en una única etiqueta àmplia. Les categories de Ray Guardian són més específiques.
  • Mancances de context. Algunes etiquetes depenen del peu de foto, l'àudio, l'escena circumdant o la intenció humana. Aquestes proves mesuren el contingut visible.
  • Canvi de domini. Els conjunts de dades externs inclouen retalls, resolucions, imatges generades, gravacions de videovigilància, primers plans d'objectes i imatges mèdiques diferents.
  • Dissenys de tasca diferents. Les avaluacions comparatives de reconeixement d'objectes són proves d'esforç útils, però el reconeixement d'objectes no és idèntic a la moderació de seguretat visual.

L'avaluació comparativa alineada mostra el rendiment en la taxonomia de producte de Ray Guardian. Els conjunts de dades de referència mostren com aquesta taxonomia es transfereix a dades externes més desordenades.

Com s'ha de llegir l'avaluació comparativa

Llegiu cada xifra al nivell de les etiquetes que hi ha al darrere.

  • El resultat de 13 categories mesura tota la taxonomia de seguretat de Ray Guardian a escala d'imatge.
  • Les files de vídeo mesuren Ray Guardian respecte de les etiquetes públiques de vídeo disponibles en cada conjunt de dades.
  • Les files de referència independents mesuren la transferència a sistemes d'etiquetes externs, no una substitució de l'avaluació comparativa de la taxonomia del producte.

Ray Guardian és ara la capa unificada de seguretat visual de Ray: un únic sistema per a imatges i clips, creat per detectar contingut sensible i mantenir les decisions estables mentre el contingut avança fotograma a fotograma.

Conjunts de dades d'origen

El conjunt d'avaluacions comparatives cita fonts de conjunts de dades com ara HMDB51 via FiftyOne, XD-Violence, UCF-Crime, UCF101 via FiftyOne, HoliSafe-Bench, UnsafeBench, Open Images V7, SurgWound i HOD Benchmark Dataset.

Subscribe to the Ray newsletter. Product updates, release notes, and customer news.

No spam. Just the Ray newsletter and important product updates.

Continua llegint

Comparativa ASR de Ray: 98 llengües, resultats complets3 min readPer què cada subtítol que descarregues és una aposta, i com ho resol Ray2 min readPreguntes freqüents sobre Ray: tot el que necessites saber2 min read