Plataformas de Entrevista com IA Testadas: CodeSignal, Humanly, Eightfold na Triagem de Empregos

A repórter sênior de IA da The Verge, Hayden Field, testou três plataformas de entrevistas com IA para triagem de empregos: CodeSignal, Humanly e Eightfold. Essas plataformas usam avatares de IA para conduzir entrevistas em vídeo individuais com candidatos a empregos, fazendo perguntas e analisando respostas.
Como Funcionam as Plataformas de Entrevista com IA
As ferramentas de IA operam fazendo com que os candidatos participem de chamadas de vídeo onde um avatar de IA faz perguntas e avalia as respostas. As empresas por trás dessas plataformas afirmam que elas permitem que as organizações entrevistem virtualmente todos os candidatos para a triagem inicial, em vez de apenas um subconjunto. Alguns argumentam que esses sistemas analisam respostas em vez de sinais visuais, potencialmente reduzindo preconceitos.
Limitações e Desafios
Apesar das alegações de redução de preconceitos, o artigo observa que sistemas de IA totalmente imparciais são impossíveis de alcançar. Os modelos são treinados em grandes conjuntos de dados da internet contendo sexismo, racismo e outros preconceitos. Field relatou que, embora algumas plataformas parecessem mais naturais do que outras, cada vez ela desejava estar conversando com um humano. Ela mencionou especificamente ter dificuldades com o efeito "vale da estranheza" de olhar para um avatar de IA ouvindo suas respostas.
Metodologia de Teste
Field testou as plataformas para vários empregos, incluindo posições criadas para o exercício com base em sua função atual e empregos reais listados na Vox Media. Os testes revelaram diferenças em quão natural cada plataforma parecia, embora todas compartilhassem a limitação fundamental de serem entrevistas conduzidas por IA em vez de por humanos.
📖 Read the full source: HN AI Agents
👀 See Also

Modelos Locais vs Nuvem: Qwen-3.6-27B, Gemma-4-31B, Claude Haiku, Codex-Spark em Geração de Código Complexo
Um usuário testou o Qwen-3.6-27B (q4_k_m) localmente em uma RTX 5080 contra os modelos baseados em API Gemma-4-31B, Claude Haiku 4.5 e Codex-Spark em uma tarefa de código complexa. Apenas o Codex-Spark produziu código completo (mas com erros de importação); todos os outros falharam parcialmente. Custo: Gemma usou $0,112 para 803k tokens de entrada.

Google Chrome baixa silenciosamente modelo Gemini Nano de 4GB sem consentimento
O Chrome baixa automaticamente um modelo Gemini Nano de 4GB (weights.bin) para os dispositivos dos usuários sem consentimento ou opção de recusa, e o baixa novamente se for excluído. Isso levanta preocupações legais (ePrivacy/GDPR) e ambientais na escala de bilhões de dispositivos do Chrome.

Modelos Qwen3 Small Ajustados Superam LLMs de Ponta em Tarefas Específicas com Custo Menor
Modelos Qwen3 destilados (0,6B a 8B parâmetros) igualaram ou superaram modelos de API de fronteira como GPT-5, Gemini e Claude em 6 de 9 tarefas, incluindo chamada de funções e Text2SQL, com custo tão baixo quanto US$ 3 por milhão de requisições versus US$ 378 para desempenho comparável.

Agentes Gerenciados Claude Adiciona Sonhos, Resultados, Orquestração Multiagente e Webhooks
Sonhar é um processo programado de curadoria de memória que melhorou as taxas de conclusão de tarefas em aproximadamente 6x nos testes da Harvey. Resultados, orquestração multiagente e webhooks agora estão em beta público na Plataforma Claude.