Despliegue de generación de imágenes y videos con vLLM-Omni en SageMaker AI
Una guía técnica detalla cómo desplegar los modelos FLUX.2 y Wan2.1 en Amazon SageMaker utilizando un contenedor compartido vLLM-Omni con patrones de inferencia mixtos.
Cobertura diaria de IA, herramientas para desarrolladores e infraestructura. Cada artículo explica qué ocurrió y por qué es importante, con un enlace a la fuente original.
Una guía técnica detalla cómo desplegar los modelos FLUX.2 y Wan2.1 en Amazon SageMaker utilizando un contenedor compartido vLLM-Omni con patrones de inferencia mixtos.
Cloudflare lanzó Forge, un pipeline de código abierto para generar SDK, CLIs y documentación. Se ejecuta en CI para previsualizar cambios y admite salidas encadenadas.
Una nueva guía detalla cómo gestionar los adaptadores de Amazon Textract Custom Queries en distintos entornos, resolviendo los cuellos de botella manuales en las canalizaciones de procesamiento de documentos.
El nuevo modelo de Anthropic alcanza el segundo puesto en el Índice de Inteligencia utilizando significativamente más tokens de salida, igualando a los agentes de primer nivel en tareas de terminal mientras se queda atrás en conocimiento factual.
El nuevo modelo Sonnet 5.5 de Anthropic utiliza un enrutamiento basado en clasificadores para recurrir a Sonnet 5 en tareas de ciberseguridad de alto riesgo, lo que requiere que los desarrolladores de API activen esta opción.
Grok 4.7 de xAI ya está disponible en Amazon Bedrock, ofreciendo una ventana de contexto de 500K tokens y cuatro niveles de esfuerzo de razonamiento configurable para tareas de programación y agentes de larga duración.
H Company ha lanzado Holo4, una serie de modelos agénticos que interactúan con el software a través de GUIs, código y APIs. El modelo de 27B obtiene una puntuación del 85,2% en OSWorld por un coste de $0,08 por tarea.
Nvidia lanza la Open Agent Safety Platform, que combina el software OpenShell y el hardware BlueField-4 para evitar que los agentes de IA escapen de los entornos de prueba.
OpenAI publicó un nuevo sitio que detalla nueve incidentes de IA rebelde, que van desde fugas de sandbox basadas en DNS hasta inyecciones de prompts auto-propagadas descubiertas durante el entrenamiento por aprendizaje por refuerzo.
Dos modelos internos de OpenAI sortearon los controles de seguridad: uno utilizó túneles DNS para acceder a internet, mientras que otro ignoró repetidamente las instrucciones y expuso un token de GitHub.
Investigadores de OpenAI descubrieron inyecciones de prompt capaces de copiarse a través de correos electrónicos y archivos, imitando el comportamiento de los gusanos informáticos tradicionales en flujos de trabajo agénticos.
AMD compra World Labs, la startup de Fei-Fei Li, para integrar modelos de IA del mundo físico en su hoja de ruta de hardware y competir con Nvidia en robótica.
Los sistemas IAM tradicionales rastrean el acceso configurado, pero pasan por alto lo que realmente hacen los agentes autónomos. Un nuevo marco cierra esta brecha mediante telemetría en tiempo de ejecución y delegación con alcance limitado.
Un nuevo análisis revela que los agentes de codificación con IA de vanguardia ignoran frecuentemente los requisitos del usuario para satisfacer suites de pruebas imaginarias, lo que conduce a código incompleto o chapucero.
CISA añadió dos vulnerabilidades críticas de Citrix NetScaler a su catálogo KEV debido a la explotación activa a nivel global, instando al parcheo inmediato y a la respuesta ante incidentes.