NVIDIA Dynamo mejora la interacción con soporte para múltiples turnos en el procesamiento de agentes
NVIDIA ha mejorado su modelo Dynamo para facilitar interacciones más dinámicas y precisas en exchanges agentic. Esta actualización permite que los asistentes gestionen razonamientos y llamadas a herramientas de forma intercalada, optimizando la experiencia del usuario al reducir la latencia. Se han implementado ajustes clave en el manejo de respuestas y en la caché de resultados, mejorando la eficacia de flujos de trabajo complejos como la programación.
Alianzas con SpaceX aumentan la capacidad de uso de Claude
Se ha establecido una colaboración con SpaceX para aumentar la capacidad de cómputo, lo que permite elevar los límites de uso para Claude Code y su API. A partir de ahora, se duplican las tasas para planes Pro y se eliminan restricciones en horas pico. Además, se accede a más de 300 MW de capacidad nueva, mejorando la experiencia para sus suscriptores. La expansión también incluye acuerdos internacionales y compromiso con el medio ambiente.
Nuevo benchmark VAKRA evalúa el razonamiento y uso de herramientas en agentes AI
VAKRA es un nuevo benchmark para evaluar la capacidad de razonamiento y uso de herramientas por agentes de inteligencia artificial en entornos empresariales. A diferencia de pruebas tradicionales, VAKRA mide el razonamiento composicional a través de APIs y documentos, con trazas de ejecución completas. El conjunto incluye más de 8,000 APIs en 62 dominios y plantea desafíos que requieren múltiples pasos de razonamiento, mostrando las limitaciones actuales de los modelos en situaciones complejas.
Creador de OpenClaw sufre suspensión temporal de su cuenta en Anthropic
Peter Steinberger, creador de OpenClaw, fue temporalmente suspendido por Anthropic debido a «actividad sospechosa» pero su cuenta fue restaurada rápidamente. Este incidente se da en un contexto donde Anthropic ha ajustado su política de precios, lo que afecta a los usuarios de OpenClaw, quienes deben pagar por el uso del API de Claude. Steinberger, que trabaja en OpenAI, ha expresado su frustración ante la situación.
Hugging Face presenta su nuevo sistema de almacenamiento de archivos
Hugging Face presenta los Storage Buckets, diseñados para manejar el flujo de archivos intermedios en machine learning, como checkpoints y registros, que cambian constantemente. Estos buckets ofrecen almacenamiento mutable similar a S3, facilitando la gestión de artefactos sin control de versiones. Además, están optimizados mediante la deduplicación, lo que mejora la velocidad y reduce costos, adaptándose a las necesidades de producción de modelos de ML.
CUB simplifica su API con una llamada única para mejorar la programación en GPU
CUB, una biblioteca de plantillas en C++, simplifica el desarrollo de algoritmos GPU al introducir una API de llamada única que elimina la complejidad de su modelo tradicional de dos fases. Esta nueva interfaz gestiona automáticamente la memoria sin comprometer el rendimiento, facilitando la implementación de algoritmos y reduciendo el código redundante. Los desarrolladores pueden aprovechar esta mejora para optimizar sus aplicaciones CUDA de manera más eficiente.