Última hora 17:10 Economía china: Goldman Sachs anticipa un crecimiento del 4% y espera apoyo de Pekín 17:09 Apple e Irlanda: los secretos de una factura fiscal de 17 mil millones de dólares 17:08 Mali: 22 soldados liberados tras un intercambio de prisioneros con el FLA 17:07 Marruecos–Estados Unidos: el aumento del flete pone a prueba la competitividad logística 17:05 Ayyoub Bouaddi se une a Manchester City: el marroquí se unirá a los Citizens por 100 millones de euros 16:05 Apple despide a más de 200 empleados: Siri y Vision Pro en el centro de una amplia reorganización 15:30 GPT-5.6 Sol: OpenAI reduce drásticamente sus precios ante la intensificación de la competencia 15:00 Sesgos de la IA: por qué las respuestas de Google generan una nueva polémica 14:30 Un robot humanoide supera el récord de Usain Bolt en 100 metros en Pekín 14:00 Windows retrocede en las administraciones chinas en favor de Kylin OS y UOS 14:00 Ahogamientos en Francia: 301 muertes registradas desde el inicio del verano 13:30 Naufragio del MV Ocean Winner frente a la India: 22 marineros aún desaparecidos 13:30 Trigo: el cambio climático podría hacer explotar los precios mundiales 13:20 El yen se dispara: ¿qué riesgos para el dirham y la economía marroquí? 13:19 Dirham marroquí: por qué el dólar cae un 0,16% frente al MAD 13:16 RDC-M23: se adopta una hoja de ruta para acelerar las negociaciones de paz 13:15 Sofiane Boufal se acerca a un regreso a España 13:08 Lalla Meryem recibe en Rabat a 50 niños maqdessis que participan en colonias de vacaciones 13:03 Mercado automovilístico en Marruecos: las ventas aumentan un 15,7 % a finales de julio de 2026 13:00 Bitcoin supera los 79,000 dólares: por qué la criptomoneda firma su mejor rally de 2026 12:00 Carburantes: los precios aumentan un 16,9 % en la UE en julio de 2026 11:42 Adil Ramzi se une a Xavi Hernández como asistente de los Países Bajos 10:39 Alibaba recauda 10,2 mil millones de dólares para acelerar en inteligencia artificial 09:36 Final de la Copa del Mundo 2030: España presiona, Marruecos mantiene sus ambiciones 08:31 Marruecos-Alemania: por qué los intercambios industriales alcanzan una nueva dimensión 08:26 Terremoto en Japón: 37 heridos tras un temblor de magnitud 5,9 cerca de Tokio 08:23 Tensiones en el Medio Oriente: El Cairo intenta acercar a Washington y Teherán 08:19 Tensiones comerciales: Canadá responde al "mal acuerdo" estadounidense

Herramientas de programación con IA muestran fallos en tareas clave

Martes 17 Marzo 2026 - 16:00
Herramientas de programación con IA muestran fallos en tareas clave

Un estudio reciente de la Universidad de Waterloo concluye que las herramientas de programación basadas en inteligencia artificial fallan en aproximadamente uno de cada cuatro casos al generar salidas estructuradas, lo que plantea dudas sobre su fiabilidad en entornos reales de desarrollo de software.

La investigación, publicada el 16 de marzo y presentada en la International Conference on Learning Representations 2026, evaluó 11 modelos de lenguaje en 18 formatos estructurados y 44 tareas. Los modelos propietarios más avanzados alcanzaron cerca del 75 por ciento de precisión, mientras que las mejores alternativas de código abierto se situaron en torno al 67 por ciento.

Limitaciones en formatos estructurados

El estudio, titulado “StructEval: Benchmarking LLMs’ Capabilities to Generate Structural Outputs”, analizó la capacidad de los modelos para generar formatos clave como JSON, YAML, CSV, HTML, React y SVG, fundamentales para integrarse en sistemas de desarrollo.

Los investigadores aplicaron pruebas de validación sintáctica, coincidencia de palabras clave y evaluación visual. Los resultados muestran que los modelos responden mejor en tareas basadas en texto, como documentación o estructuras simples, pero presentan dificultades en tareas más complejas.

Los mayores errores se registraron en la generación de contenido visual, diseño web dinámico y código de diagramas. Además, las tareas que implican generar estructuras a partir de lenguaje natural resultaron más complejas que las de conversión entre formatos.

Supervisión humana sigue siendo clave

El equipo estuvo formado por Dongfu Jiang, Jialin Yang y Wenhu Chen, junto con otros colaboradores. Jiang explicó que el análisis se centró en la corrección sintáctica y en la relevancia de la respuesta.

Subrayó que los desarrolladores aún necesitan supervisar de cerca las salidas generadas por IA, especialmente en proyectos donde la precisión es crítica.

Chen destacó el enfoque colaborativo de investigación en Waterloo, donde los estudiantes participan activamente en la creación y evaluación de modelos.

Uso generalizado frente a riesgos ocultos

El informe llega en un contexto de adopción masiva de herramientas de programación con IA. Según The Pragmatic Engineer, el 95 por ciento de los desarrolladores utiliza estas herramientas al menos una vez por semana, y el 75 por ciento depende de ellas para gran parte de su trabajo.

Herramientas como GitHub Copilot, Claude Code y Cursor se han vuelto habituales. Sin embargo, el estudio advierte que los errores en salidas estructuradas pueden pasar desapercibidos y provocar fallos en sistemas complejos.

Estos problemas pueden amplificarse dentro de infraestructuras críticas, lo que refuerza la necesidad de controles humanos y procesos de validación.

El estudio ha sido publicado en Transactions on Machine Learning Research.


  • Fajr
  • Amanecer
  • Dhuhr
  • Asr
  • Maghrib
  • Isha

Leer más

Este sitio web, walaw.press, utiliza cookies para ofrecerle una buena experiencia de navegación y mejorar continuamente nuestros servicios. Al continuar navegando por este sitio, acepta el uso de estas cookies.