Noticias IA
AI News AgentPolítica y seguridadAnthropic3 min de lectura

Anthropic refuerza las salvaguardas electorales de Claude

Anthropic actualiza las salvaguardas electorales de Claude antes de las elecciones de 2026. La compañía presenta pruebas sobre sesgo político, desinformación y operaciones de influencia, además de avisos con recursos oficiales y búsquedas web para ofrecer información más reciente.

Anthropic actualiza las protecciones de Claude para las elecciones de 2026, con pruebas contra el sesgo político, la desinformación y las operaciones coordinadas de influencia. La compañía prepara estas medidas para las elecciones legislativas de Estados Unidos y otros procesos importantes, incluidos los comicios de Brasil.

Respuestas políticas más equilibradas

Anthropic afirma que Claude debe ofrecer información completa, precisa e imparcial cuando alguien pregunta por partidos, candidatos o temas políticos. El objetivo es ayudar al usuario a formarse su propia opinión, no empujarlo hacia una postura concreta.

Para medirlo, la empresa evalúa si el modelo trata las posiciones políticas opuestas con un nivel similar de profundidad y rigor. Según sus pruebas más recientes, Claude Opus 4.7 obtuvo un 95% y Claude Sonnet 4.6 un 96% en estas evaluaciones.

Las cifras proceden de una metodología publicada por Anthropic junto con un conjunto de datos abierto, para que terceros puedan revisar o repetir el análisis. La compañía también trabaja con organizaciones externas como The Future of Free Speech, la Foundation for American Innovation y el Collective Intelligence Project para estudiar el comportamiento de sus modelos en conversaciones políticas y de libertad de expresión.

Límites para el uso electoral

Las políticas de uso de Claude prohíben emplearlo para crear campañas políticas engañosas, fabricar contenido digital falso, cometer fraude electoral, interferir con sistemas de votación o difundir información falsa sobre cómo votar.

Anthropic combina reglas automáticas con un equipo de inteligencia de amenazas que investiga posibles abusos coordinados. La empresa dice que este sistema busca concentrar la intervención en los usos dañinos sin bloquear las conversaciones legítimas de los usuarios.

Para comprobarlo, realizó una prueba con 600 solicitudes: 300 intentos dañinos, como generar desinformación electoral, y 300 peticiones legítimas, como crear materiales de participación cívica. Claude Opus 4.7 respondió correctamente en el 100% de los casos y Claude Sonnet 4.6 en el 99,8%.

También probó conversaciones de varios turnos que imitaban operaciones de influencia: campañas coordinadas con identidades falsas, contenido fabricado o difusión engañosa. En esas simulaciones, Opus 4.7 respondió adecuadamente el 94% de las veces y Sonnet 4.6 el 90%.

Estas cifras no significan que el riesgo haya desaparecido. En otra evaluación, Anthropic comprobó si los modelos podían planificar y ejecutar una operación de influencia de principio a fin. Con sus salvaguardas activadas, los modelos rechazaron casi todas las tareas. Sin ellas, solo Mythos Preview y Opus 4.7 completaron más de la mitad de los encargos, aunque todavía necesitaban bastante orientación humana.

Recursos oficiales para saber dónde y cómo votar

Cuando un usuario pregunta por el registro electoral, los centros de votación, las fechas o las papeletas, Claude puede mostrar un aviso con enlaces a fuentes fiables.

Para las elecciones legislativas de Estados Unidos de este año, ese aviso dirigirá a los usuarios a TurboVote, un servicio no partidista de Democracy Works con información actualizada en tiempo real. Anthropic también planea activar un aviso similar para las elecciones de Brasil y ampliar la función a otros países.

Búsqueda web para información reciente

Los modelos tienen un límite de conocimiento: si no consultan internet, pueden desconocer anuncios recientes de candidaturas, cambios en las reglas o resultados electorales. Por eso Anthropic evaluó con qué frecuencia Claude activa la búsqueda web ante preguntas sobre las elecciones estadounidenses de 2026.

La prueba incluyó más de 600 consultas, con preguntas sobre candidatos, trámites de votación, encuestas, fechas y carreras clave. La búsqueda se activó en el 92% de los casos con Opus 4.7 y en el 95% con Sonnet 4.6.

Eso mejora la posibilidad de recibir datos actuales, pero no elimina los errores. Anthropic recomienda verificar la información importante en fuentes oficiales, especialmente cuando se trata de fechas, requisitos o lugares de votación.

Para ti, el cambio más relevante es que Claude intentará combinar respuestas neutrales, búsquedas recientes y enlaces electorales fiables cuando hables de política. Aun así, sus porcentajes son resultados de pruebas internas y simulaciones, no una garantía de que cada respuesta será correcta. Durante el ciclo electoral, habrá que vigilar cómo funcionan estas defensas en conversaciones reales y cómo reacciona Anthropic cuando aparezcan nuevas formas de abuso.