Claude, GPT y GLM lideran: MWS AI probó la capacidad de las redes neuronales para detectar documentos falsificados

El conjunto experimental no refleja completamente las condiciones reales de verificación de documentos

El equipo de MWS AI, parte de MTS Web Services, probó redes neuronales multimodales para detectar signos de falsificación de documentos. Para ello, los investigadores ampliaron el benchmark abierto MWS AI Vision Bench, añadiendo un conjunto de tareas Anti-fraude.

Fuente de la imagen: IA Grok

El conjunto de datos incluyó 430 imágenes: 200 documentos originales, 130 con modificaciones manuales y 100 creadas por modelos generativos. Las redes neuronales debían clasificar las imágenes, encontrar elementos sospechosos y determinar la sustitución de detalles, así como distinguir los originales de las imágenes generadas por IA.

Entre los líderes en la detección de falsificaciones se encontraban los modelos de las familias Claude, GPT y GLM. Sin embargo, los altos resultados en el reconocimiento y análisis de documentos no garantizan una detección igualmente efectiva de los cambios. Por ejemplo, GPT-6.1 Sol ocupó el primer lugar en la evaluación general, pero el tercero en la categoría Anti-fraude. El mejor resultado en esta última lo mostró Claude Opus 5.5.

MWS AI señaló que el conjunto experimental no refleja completamente las condiciones reales de verificación de documentos. Por lo tanto, los resultados Anti-fraude se publican por separado de la clasificación general. Según los desarrolladores del benchmark, para protegerse contra el fraude en procesos reales, son preferibles las soluciones especializadas.