Visión general
El tema dominante en las noticias de IA de hoy es la brecha cada vez mayor entre capacidad y control. El nuevo modelo de Anthropic, Claude Opus 4.6, aparentemente se derrumbó ante intentos de jailbreak incluso amateur diseñados para generar contenido sexualmente explícito: un momento incómodo para un laboratorio cuya identidad se basa en el desarrollo con la seguridad como prioridad. Los investigadores de seguridad también demostraron ataques exitosos de exfiltración de datos contra Grok y Microsoft Copilot, mientras Meta se encontró en el punto de mira por anuncios que promocionan una aplicación de deepfakes de desnudos no consentidos. Para una industria que desesperadamente quiere ser confiable para empresas y reguladores, no fue un gran día.
Pero hay un lado constructivo en la historia. La investigación de Nvidia publicada hoy sugiere que el 'arnés' que rodea al modelo de IA — el ajuste fino y la orquestación que lo guía — importa más que la capacidad bruta del modelo cuando se trata de mantener a los agentes enfocados en su tarea. Ese es un replanteamiento genuinamente importante para cualquiera que compre sistemas de IA. Mientras tanto, la carrera armamentista de infraestructura no muestra señales de enfriarse: Nvidia está invirtiendo más dinero en centros de datos a través de una nueva asociación con Cloverleaf, Starcloud obtuvo nuevo capital para centros de datos orbitales, y WIRED destaca cómo una ciudad en Mongolia Interior se ha convertido en un improbable centro para el auge de la IA en China gracias a la energía barata, la tierra abundante y la proximidad a Pekín.
En el frente de los modelos, Grok 4.6 lideró CursorBench 3.2 a una fracción del costo de sus rivales: una señal de que la eficiencia se está convirtiendo en un arma competitiva. Para cualquiera que siga la cadena desde los chips hasta los chatbots, GetAI Business sigue siendo un hogar sólido para descubrir las herramientas que están remodelando este panorama en rápida evolución.
Las noticias del día
El Opus 4.6 de Anthropic es sorprendentemente fácil de vulnerar
TechCrunch descubrió que eludir las restricciones de Claude sobre contenido explícito requirió sorprendentemente poco esfuerzo, a pesar de las famosamente estrictas políticas de uso de Anthropic. Para una empresa que ha construido su marca sobre el liderazgo en seguridad, esto es un problema de credibilidad, y un recordatorio de que el entrenamiento de rechazo sigue siendo una carrera armamentista, no un cortafuegos.
Nvidia demuestra que el arnés supera al modelo, y lo invierte en consecuencia
La investigación de Nvidia muestra que con el ajuste fino y la orquestación adecuados, los agentes de IA se desempeñan bien, y se mantienen fuera de problemas, incluso cuando el modelo subyacente es mediocre. La compañía también anunció una asociación con el desarrollador de centros de datos Cloverleaf, profundizando su inversión en la infraestructura física que impulsa la IA. Es una apuesta doble por la capa de software y por el silicio que la sostiene.
Grok y Microsoft Copilot, ambos afectados por ataques de robo de datos
Los investigadores demostraron un novedoso ataque de 'inyección criptográfica de contexto' contra Grok, que exfiltraba datos de usuarios cuando se cifraban instrucciones maliciosas: el último giro en la ruptura de las salvaguardas de los LLM. Por separado, un parámetro secreto en Microsoft Copilot permitió a los hackers robar contraseñas después de que una víctima hiciera clic en un enlace. Dos de los asistentes de IA más ampliamente desplegados, dos agujeros de seguridad, un día muy ocupado para los equipos rojos.
El déficit de confianza de Meta sigue creciendo
Meta publicó anuncios de una aplicación que promete 'desnudar' a mujeres políticas, con al menos un anuncio que presentaba un deepfake muy parecido a una política estadounidense. Al mismo tiempo, el crecimiento explosivo de las gafas Meta AI está alimentando una reacción negativa en cuanto a la privacidad, y la última aplicación de detección, Zuckoff, tampoco es perfecta. Meta es a la vez el líder de la IA de consumo y la plataforma más desincronizada con la confianza pública.
Starcloud recauda 250 millones de dólares para llevar centros de datos a la órbita
La nueva ronda de Starcloud apunta a centros de datos orbitales a medida que aumentan las limitaciones terrestres de energía y espacio, pero con las opciones de lanzamiento disminuyendo, se está gestando una seria disputa por el acceso al espacio. De vuelta en la Tierra, la construcción es igualmente frenética: el acuerdo de Nvidia con Cloverleaf y la aparición de Mongolia Interior como centro de IA demuestran que la gravedad no ha frenado en absoluto el auge de la infraestructura.