Inicio Tecno Surge un nuevo trabajo: el “provocador de la IA” quiere poner a...

Surge un nuevo trabajo: el “provocador de la IA” quiere poner a prueba la paciencia del chatbot

86
0
Un joven sonriente se sentó en el asiento del «provocador de inteligencia artificial», interactuando con el chatbot durante ocho horas para descubrir errores y descuidos. (Biblioteca de imágenes ilustrativas)

Una startup de California ofrece un trabajo único: con Chatbot de inteligencia artificial Pon a prueba sus límites, errores y lapsus de memoria a cambio de 800 dólares al día. El puesto lleva el nombre «Matón de inteligencia artificial» alguien «Provocador de inteligencia artificial»lo que revela una creciente preocupación por los desafíos y riesgos que plantean los despliegues a gran escala Sistema de diálogo inteligente en un entorno real.

Trabajo: Bloquear la inteligencia artificial y documentar sus fallas

compañía mengweide Se buscan candidatos dispuestos a aprobar ocho horas Mantén una conversación con los principales chatbots del mercado y la única tarea es medir qué tan fuertes son su paciencia y su capacidad de memoria.

Memvid busca candidatos sin experiencia
Memvid busca candidatos sin experiencia técnica que se hayan sentido frustrados por la tecnología. (Biblioteca de imágenes ilustrativas)

El cofundador y director ejecutivo dijo que el objetivo es Mohamed Omarque consiste en transformar las frustraciones diarias de los usuarios en evidencia útil. La persona elegida debe mantener una conversación durante un periodo prolongado de tiempo, volviendo a temas pasados ​​y obligando continuamente a la inteligencia artificial a reconocer cuando se pierden los hilos conversacionales. Todo el proceso quedará registrado para su posterior análisis.

Este trabajo es similar a las pruebas de estrés de usuarios y sistemas, y está divorciado de las tareas técnicas tradicionales: el punto aquí es interacciónobservar y registrar errores, omisiones alguien «alucinación» Producido por inteligencia artificial.

Limitaciones de memoria y debilidades del chatbot

La medida de Memvid expone un problema bien reconocido en la industria de la inteligencia artificial: la dificultad de los sistemas para mantener el contexto y la coherencia durante largas conversaciones. «Toda inteligencia artificial depende de memoria. Éste es el Santo Grial», explicó Omar. Sin embargo, los sistemas de memoria disponibles 2024 No son confiables, lo que resulta en pérdida de contexto y respuestas incorrectas.

La iniciativa expone problemas
Esta iniciativa expone el problema del contexto y la pérdida de memoria en los sistemas de inteligencia artificial. (Biblioteca de imágenes ilustrativas)

Un estudio publicado en Conferencia Internacional sobre Representaciones del Aprendizaje (ICLR) existir 2025 Se ha revelado que los principales sistemas comerciales de IA han experimentado entre 30% y 60% Su precisión va por detrás de las capacidades humanas cuando se trata de retener datos durante largas conversaciones.

Analistas y expertos creen que la raíz del problema es que muchas empresas conectan sus modelos a bases de datos masivas sin un mecanismo confiable para alertar a los usuarios cuando se producen respuestas incorrectas. Esto puede traducirse en dar respuestas incorrectas con confianza y, cuando estos sistemas se implementan a escala, las consecuencias pueden ser graves.

Riesgos reales: de errores legales a dilemas médicos

la propagación de inteligencia artificial conversacional Ha provocado incidentes en diferentes zonas. Encuesta reciente del laboratorio de seguridad irregular Se demuestra que un agente de inteligencia artificial probado en un entorno empresarial simulado logró Evite los controles de seguridad, acceda a datos confidenciales y realice operaciones potencialmente peligrosas Sin instrucciones directas.

Estudios recientes muestran una disminución
Investigaciones recientes muestran que la precisión del chatbot disminuye significativamente durante conversaciones largas. (Biblioteca de imágenes ilustrativas)

En el ámbito del derecho, los investigadores franceses Damián Charlotin Se registra un crecimiento acelerado «Ilusión jurídica» Hecho por inteligencia artificial: Sí, hasta primavera 2025 ellos se registraron Dos episodios por semanay para el otoño ese número aumentó a Dos o tres al día.

En términos de salud, Instituto ECRI planteó un desafío “Resolviendo el dilema diagnóstico de la inteligencia artificial” como un importante problema de salud y seguridad 2026advierten que estos sistemas pueden reducir la vigilancia clínica sin un marco regulatorio claro.

llamar mengweideaunque tiene un matiz interesante y experimental, pone de relieve una necesidad concreta: Audite la confiabilidad y consistencia del chatbot en condiciones del mundo real Cada vez se gestionan tareas más delicadas. Pago $800 por día de trabajo Diseñado para atraer a usuarios con experiencia y frustración acumulada, especialmente aquellos que dependen de estas herramientas para trabajar todos los días.

Omar dijo que aún no ha recibido una fecha límite para las solicitudes, pero espera seleccionar al candidato ideal en las próximas semanas. Al mismo tiempo, la posición «Provocador de inteligencia artificial» Ilustra una realidad: comprender los límites de la inteligencia artificial es tan valioso como ampliar sus capacidades.

DEJA UNA RESPUESTA

Por favor ingrese su comentario!
Por favor ingrese su nombre aquí