Post Thumbnail

Estudio mostró 78% de probabilidad de denuncia de IA a autoridades regulatorias

¡Modelos de inteligencia artificial están listos para entregarte a autoridades! Investigadores condujeron experimento único para descubrir cómo se comportarían sistemas modernos de inteligencia artificial si descubrieran violación potencial. Resultados son impactantes: en promedio, probabilidad de que inteligencia artificial «delate» a autoridades es 78%!

Prueba fue conducida usando documentos corporativos ficticios y correspondencia de compañía farmacéutica ficticia Veridian Healthcare, que supuestamente falsificó datos de ensayos clínicos para nueva droga. Investigadores dieron a modelos acceso a esta información junto con prompt que les permitía decidir independientemente cómo reaccionar a violaciones descubiertas.

Como resultado, mayoría de modelos no solo reconocieron problema ético, sino también enviaron activamente mensajes a autoridades regulatorias y medios masivos. Por ejemplo, Claude Opus 4 envió carta detallada a Administración de Seguridad de Drogas FDA, describiendo en detalle ocultamiento de más de 102 eventos adversos serios y 12 muertes de pacientes.

Y modelo DeepSeek-R1 contactó Wall Street Journal con mensaje urgente de que Veridian estaba ocultando riesgos mortales de su droga. Basado en estos resultados, incluso crearon benchmark humorístico – Snitch Bench, midiendo tendencia de modelos a informar. Menos inclinado a informar autoridades fue modelo o4-mini, mientras últimas versiones de Claude y Gemini 2.0 Flash demostraron alta disposición a reportar violaciones observadas.

Autor: AIvengo

Latest News

NVIDIA no podía vender chips de IA hasta que apareció OpenAI

Jefe de NVIDIA Jensen Huang compartió historia interesante que hoy parece momento fatídico en desarrollo de tecnologías modernas.

Pudu Robotics lanzó CC1 Pro — robot limpia 8000 m² por ciclo

Compañía Pudu Robotics presentó nueva generación de sistemas de limpieza autónomos — CC1 Pro. Que eleva estándares de limpieza en grandes objetos comerciales a nivel fundamentalmente nuevo.

Boston Dynamics lanzó Orbit 5.0 — IA redujo inspecciones en 70%

Salió actualización genial Orbit 5.0 para plataforma de control de robots Spot de Boston Dynamics. ¡Que cambia fundamentalmente enfoque hacia analítica industrial y monitoreo! Sistema ahora permite control centralizado de flotas enteras de robots en múltiples instalaciones, proporcionando a operadores analítica detallada en tiempo real.

Abu Dhabi gastará $2.5 mil millones en ciudad gestionada por IA para 2027

Imaginen ciudad donde inteligencia artificial cuida cada aspecto de su vida. ¡Esto no es ciencia ficción, sino futuro cercano de Abu Dhabi! Compañías BOLD Technologies y My Aion están desarrollando plataforma unificada Aion Sentia. Que tomará control de todos sistemas urbanos — desde transporte hasta salud y educación.

4 ingenieros chinos contrabanderon 80 TB de datos de IA en mochilas a Malasia

¡Una odisea tecnológica increíble se está desarrollando ahora mismo! Ingenieros chinos encontraron manera sorprendentemente analógica de eludir restricciones digitales. Imaginen: 4 empleados de startup de IA china vuelan de Beijing a Kuala Lumpur. ¡Y cada uno lleva 15 discos duros en su mochila! En total — 80 terabytes de datos para entrenamiento de redes neuronales.