Plataformas de Entrevistas con IA Evaluadas: CodeSignal, Humanly, Eightfold en la Preselección de Empleo

La reportera senior de IA de The Verge, Hayden Field, probó tres plataformas de entrevistas con IA para la selección de personal: CodeSignal, Humanly y Eightfold. Estas plataformas utilizan avatares de IA para realizar entrevistas de video uno a uno con los solicitantes de empleo, haciendo preguntas y analizando las respuestas.
Cómo funcionan las plataformas de entrevistas con IA
Las herramientas de IA operan haciendo que los solicitantes participen en videollamadas donde un avatar de IA hace preguntas y evalúa las respuestas. Las empresas detrás de estas plataformas afirman que permiten a las organizaciones entrevistar virtualmente a cada solicitante para la selección inicial en lugar de solo a un subconjunto. Algunos argumentan que estos sistemas analizan las respuestas en lugar de las señales visuales, lo que potencialmente reduce el sesgo.
Limitaciones y desafíos
A pesar de las afirmaciones de reducción del sesgo, el artículo señala que los sistemas de IA libres de sesgo son imposibles de lograr. Los modelos se entrenan con grandes conjuntos de datos de internet que contienen sexismo, racismo y otros sesgos. Field informó que, aunque algunas plataformas se sentían más naturales que otras, cada vez deseaba estar hablando con un humano en su lugar. Mencionó específicamente que luchó con el efecto del "valle inquietante" de mirar a un avatar de IA escuchando sus respuestas.
Metodología de prueba
Field probó las plataformas para varios trabajos, incluidos puestos creados para el ejercicio basados en su rol actual y trabajos reales listados en Vox Media. Las pruebas revelaron diferencias en lo natural que se sentía cada plataforma, aunque todas compartían la limitación fundamental de ser entrevistas impulsadas por IA en lugar de realizadas por humanos.
📖 Read the full source: HN AI Agents
👀 Ver también

Resultados AIME 2026: Modelos abiertos y cerrados superan el 90%
Modelos de IA logran 90%+ en AIME 2026, con DeepSeek V3.2 ejecutando toda la prueba por solo bash.09.

ThermoQA: Punto de Referencia Abierto para Ingeniería Termodinámica Evalúa Modelos de Lenguaje en 293 Problemas de Cálculo
ThermoQA es un punto de referencia abierto con 293 problemas de termodinámica de ingeniería en tres niveles, que evalúa a los LLM en cálculos numéricos exactos. Claude Opus 4.6 lidera con un 94.1% de puntuación compuesta, mientras que DeepSeek-R1 muestra la mayor variabilidad entre ejecuciones en ±2.5%.

Demostrando la Identidad del Modelo con la Tecnología Modelwrap de Tinfoil
El Modelwrap de Tinfoil asegura que los proveedores de inferencia sirvan los pesos de modelo exactos que afirman usar, utilizando compromisos criptográficos verificados por enclaves seguros.

Claude Sonnet 4.6 Revelado: Capacidades Mejoradas de Codificación y Uso de Computadoras
Claude Sonnet 4.6 presenta una ventana de contexto de 1M de tokens y mejora las habilidades de codificación y uso de computadoras, convirtiéndolo en una fuerte alternativa a los modelos de clase Opus para una gama más amplia de tareas.