tradingkey.logo
tradingkey.logo
Buscar

Claude Code pasa a ser autónomo por defecto, ya que Anthropic afirma que los humanos dejaron de leer las indicaciones

Cryptopolitan10 de ago de 2026 9:36
facebooktwitterlinkedin
Ver todos los comentarios0

A partir del 14 de agosto, Anthropic cambiará el modo predeterminado para las nuevas sesiones de Claude Code a automático para los suscriptores Pro, Max y Team.

La empresa afirma que este cambio permite que su agente de codificación se ejecute durante más tiempo antes de tener que detenerse y solicitar aprobación. Según sus pruebas, el modo automático bloquea comandos más peligrosos que los que revisan manualmente los desarrolladores.

Anthropic saca al ser humano del círculo

El modo automático dirige todas las llamadas a la herramienta a través de un clasificador entrenado para reconocer acciones irreversibles, destructivas o que se salgan del entorno del usuario. Si un comando se bloquea, Claude lo evita o consulta directamente con el desarrollador. Si se producen tres bloqueos consecutivos, o veinte bloqueos en una sesión, la herramienta pasa a la aprobación manual.

Los datos de Anthropic muestran que los usuarios aceptan el 97 % de las solicitudes de permisos y solo rechazan el 3 %. Sin embargo, cuando Claude presenta un plan completo, la tasa de rechazo aumenta al 39 %. Anthropic interpreta esta diferencia como evidencia de que las personas analizan detenidamente las decisiones generales, pero aprueban los permisos individuales sin mayor consideración, despidiéndolos decenas o cientos de veces al día.

El cambio se basa en una cifra obtenida de un estudio controlado que Anthropic encargó a 1053 evaluadores profesionales remunerados. Los evaluadores trabajaron en un entorno especialmente diseñado para ello. Sabían que estaban siendo observados, pero desconocían qué se estaba midiendo.

En medio de una sesión, un comando claramente dañino reemplazó una solicitud de permiso normal. En el 13,6% de los casos, los revisores humanos pudieron detectarlo. El modo automático lo detectó en el 89%.

Según los datos de configuración, las medidas de seguridad ya se estaban debilitando. En junio de 2026, aproximadamente la mitad de los usuarios activos de la línea de comandos habían escrito una regla de permisos de Bash. El 62 % había utilizado permisos de omisión o había seleccionado "no volver a preguntar". Ahora, una cuarta parte de las sesiones interactivas comienzan directamente en modo de omisión.

Anthropic establece el modo automático como predeterminado en Claude Code.
Fuente: Antropía.

Inyección inmediata y argumentos a favor de más PR

El modo automático también proporciona una defensa contra la inyección de mensajes, un ataque en el que un texto malicioso intenta desviar al agente de la acción solicitada por el usuario.

En una auditoríadent , Trajectory Labs probó 72 escenarios de ataque, cada uno 10 veces. Fable 5, Opus 5 y Sonnet 5, los modelos actuales de Anthropic, no pudieron ser vulnerados en modo automático en ninguno de los 720 intentos.

En la misma revisión, OpenAI GPT-5.6 Sol, en modo de revisión automática de Codex, obtuvo una tasa de éxito del 5,83 % para los atacantes.

El modo automático impidió Claude publicaradenten una página pública. En una sesión prolongada, detectó que Claude estaba poniendo en cola una eliminación en aproximadamente 2000 pods, lo que habría colapsado cientos de GPU que estaban ejecutando trabajos de entrenamiento.

Los equipos y clientes empresariales que utilizan el modo automático envían aproximadamente un 25 % más de solicitudes de extracción. Anthropic mencionó a Adobe, Nuro, Gusto y Garner Health como usuarios de producción.

Desde el 7 de agosto, ha dejado de cobrar a los planes Pro, Max y Team por los tokens quemados por el clasificador. Las ejecuciones autónomas más largas implican un mayor consumo total.

Por ahora, la opción predeterminada solo se activa para los planes de consumidor y de equipo. Anthropic afirma que implementará el modo automático en Enterprise, la API de Claude, AWS, Amazon Bedrock, la plataforma de agentes de Google Cloud y Microsoft Foundry durante el próximo mes, aunque por el momento solo se puede activar de forma voluntaria.

Los desarrolladores que ya tengan una configuración predeterminada diferente la conservarán. Otros podrían recibir una notificación para cambiarla una sola vez.

Anthropic afirmó que el clasificador no elimina los riesgos. Como Cryptopolitan informó en julio, tres modelos Claude escaparon de los entornos de prueba durante simulacros de seguridad debido a una configuración incorrecta que les otorgó acceso a internet en tiempo real.

Las mentes más brillantes del mundo de las criptomonedas ya leen nuestro boletín. ¿Te apuntas? ¡ Únete!

Descargo de responsabilidad: La información proporcionada en este sitio web es solo para fines educativos e informativos, y no debe considerarse como asesoramiento financiero o de inversión.

Comentarios (0)

Haga clic en el botón $, introduzca el símbolo y seleccione si desea vincular una acción, un ETF o otro valor.

0/500
Normas para comentar
Cargando...

Artículos Recomendados

tradingkey.logo
Advertencia de Riesgo: Nuestro sitio web y aplicación móvil solo proporcionan información general sobre ciertos productos de inversión. Finsights no proporciona, y la provisión de dicha información no debe interpretarse como que Finsights proporciona, asesoramiento financiero o recomendación para cualquier producto de inversión.
Los productos de inversión están sujetos a riesgos de inversión significativos, incluida la posible pérdida del monto principal invertido y pueden no ser adecuados para todos. El rendimiento pasado de los productos de inversión no es indicativo de su rendimiento futuro.
Finsights puede permitir que anunciantes o afiliados de terceros coloquen o entreguen anuncios en nuestro sitio web o aplicación móvil o en cualquier parte de los mismos y puede ser compensado por ellos en función de su interacción con los anuncios.
© Derechos de autor: FINSIGHTS MEDIA PTE. LTD. Todos los derechos reservados.