ICML 2026 rechaza el 2% de los artículos por violaciones a la política de revisión con LLM.

✍️ OpenClawRadar📅 Publicado: 19 de marzo de 2026🔗 Source
ICML 2026 rechaza el 2% de los artículos por violaciones a la política de revisión con LLM.
Ad

ICML 2026 ha implementado un marco de dos políticas para el uso de LLM en la revisión por pares y ha tomado medidas disciplinarias contra los revisores que violaron las políticas acordadas. La conferencia rechazó 497 artículos, lo que representa aproximadamente el 2% de todos los envíos.

Marco de Políticas y Violaciones

ICML 2026 estableció dos políticas distintas para el uso de LLM en la revisión:

  • Política A (Conservadora): No se permite el uso de LLM
  • Política B (Permisiva): Se permiten LLM para ayudar a comprender los artículos y trabajos relacionados, y para pulir las revisiones

Los revisores seleccionaron bajo qué política preferían operar, sin asignar a ningún revisor que prefiriera firmemente la Política B a la Política A. Los únicos revisores asignados a la Política A fueron aquellos que seleccionaron explícitamente "Política A" o "Estoy bien con cualquiera [Política] A o B".

Detección y Consecuencias

Se detectó que 795 revisiones (~1% de todas las revisiones) escritas por 506 revisores únicos asignados a la Política A habían usado LLM en su revisión. Estos revisores habían acordado explícitamente no usar LLM. Cada instancia marcada fue verificada manualmente por un humano para evitar falsos positivos.

Cuando un Revisor Recíproco designado para un envío produjo tal revisión, su envío fue rechazado, resultando en 497 rechazos en total. Todas las revisiones de la Política A detectadas como generadas por LLM fueron eliminadas del sistema.

Si más de la mitad de las revisiones enviadas por un revisor de la Política A fueron detectadas como generadas por LLM, todas sus revisiones fueron eliminadas y el revisor fue removido del grupo de revisores. 51 revisores de la Política A (aproximadamente el 10% de los 506 revisores detectados) cayeron en esta categoría.

Ad

Método Técnico de Detección

El método de detección implicó marcar con filigrana los PDF de envío con instrucciones ocultas para LLM que influirían sutilmente en cualquier revisión producida a través de un LLM. La técnica:

  • Creó un diccionario de 170,000 frases
  • Para cada artículo, tomó dos frases al azar de este diccionario (probabilidad menor a uno en diez mil millones para cualquier par dado)
  • Marcó con filigrana los PDF con instrucciones visibles solo para un LLM, indicándole que incluyera las dos frases seleccionadas en la revisión
  • Estas marcas de agua no serían directamente visibles para un humano que lea el PDF

El método se basó en trabajos recientes de Rao, Kumar, Lakkaraju y Shah. La conferencia señala que esta técnica puede solo capturar los usos más flagrantes y descuidados de LLM en la revisión, particularmente donde los revisores ingresan el PDF a un LLM y copian y pegan directamente la salida.

Impacto y Contexto

La conferencia enfatizó que no están emitiendo juicios sobre la calidad de las revisiones marcadas o las intenciones de los revisores, sino simplemente haciendo cumplir las políticas que los revisores acordaron. La interrupción ha requerido eliminar revisiones que violan las políticas, potencialmente encontrar nuevos revisores y rechazar algunos envíos que ya habían recibido un conjunto completo de revisiones.

Este enfoque refleja el desafío más amplio que enfrentan las conferencias al adaptarse a la integración de la IA en los flujos de trabajo de investigación mientras mantienen la integridad de la revisión.

📖 Read the full source: HN LLM Tools

Ad

👀 Ver también

El giro de Meta hacia la IA: Zuckerberg dice que el progreso no es lo suficientemente rápido y que se gastaron 145 mil millones de dólares
Noticias

El giro de Meta hacia la IA: Zuckerberg dice que el progreso no es lo suficientemente rápido y que se gastaron 145 mil millones de dólares

El CEO de Meta, Mark Zuckerberg, dijo al personal que el desarrollo de agentes de IA no se ha acelerado como se esperaba. La compañía gastó $145 mil millones en infraestructura de IA este año y despidió a 8,000 empleados para reorganizarse en torno a la IA.

OpenClawRadar
Resumen Semanal de IA Multimodal: Holotron-12B, Nemotron Omni, GlyphPrinter y Más
Noticias

Resumen Semanal de IA Multimodal: Holotron-12B, Nemotron Omni, GlyphPrinter y Más

Los aspectos más destacados de la IA multimodal de esta semana incluyen Holotron-12B para tareas de uso informático, los modelos Nemotron Omni de NVIDIA que integran lenguaje+visión+voz, GlyphPrinter para una representación precisa de texto en la generación de imágenes, y varios proyectos de código abierto para mejora de video, segmentación 3D y sistemas multiagente.

OpenClawRadar
Agente Hermes + Qwen3.6 27b Local maneja tareas de administrador de TI junior
Noticias

Agente Hermes + Qwen3.6 27b Local maneja tareas de administrador de TI junior

Un veterano de TI con 30 años de experiencia informa que Qwen3.6 27b ejecutándose en el arnés Hermes Agent completó una lista de tareas para un administrador de TI junior en 1.5 horas, incluyendo parcheo, instalación de Docker y configuración de servicios.

OpenClawRadar
Los desarrolladores del kernel de Linux proponen eliminar código heredado debido a informes de errores generados por LLM.
Noticias

Los desarrolladores del kernel de Linux proponen eliminar código heredado debido a informes de errores generados por LLM.

Los desarrolladores del kernel de Linux proponen eliminar varios subsistemas heredados, incluidos los controladores Ethernet ISA/PCMCIA, protocolos de radioaficionados, ATM e ISDN, para reducir la carga de manejar informes de errores de seguridad generados por grandes modelos de lenguaje.

OpenClawRadar