Anthropic reduce costos de seguridad en 96% mientras bloquea ataques universales a Claude La compañía presenta Clasificadores Constitucionales de segunda generación que reducen sobrecarga computacional de 23.7% a solo 1%, disminuyen rechazos erróneos de consultas inofensivas en 87%, y mantienen tasa de detección de vulnerabilidades en 0.005 por mil consultas. Sistema de dos etapas combina…

Anthropic pagó a hackers para romper Claude: solo encontraron una vulnerabilidad en 198 mil intentos
Publicaciones Recientes
La asistencia automática elimina el “no sé”
La asistencia automática reduce la voluntad de decir “no sé” Cinco experimentos con 3.132 participantes encontraro
Imitar autores confunde a los detectores
Los detectores fallan cuando el texto imita a un autor Una prueba de Epoch AI encontró que tres detectores reconocen ca


