Si buscas las noticias del día anterior, puedes encontrarlas aquí. O si lo que buscas son las noticias del día siguiente, haz clic aquí.
El Departamento de Comercio de EE. UU. levantó las restricciones de exportación que habían forzado a Anthropic a desactivar sus modelos más potentes (Claude Fable 5 y Mythos 5). Tras las negociaciones con autoridades, Anthropic confirmó que empezará a restaurar el acceso —Fable vuelve a disponibilidad general y Mythos se está restaurando gradualmente para conjuntos aprobados—. El levantamiento marca un cambio en la política de acceso a modelos de frontera y es relevante para equipos que dependen de estas capacidades en producción; Albeará condiciones y controles adicionales según informó la compañía y la prensa. [Fuente: Computerworld]. (computerworld.com)
Anthropic presentó Claude Sonnet 5 como la versión Sonnet más orientada a agentes hasta la fecha: según la compañía, ofrece mejoras en razonamiento, uso de herramientas y trabajo de código a un coste menor que modelos Opus de mayor capacidad. Sonnet 5 llega con precios introductorios y está disponible en la plataforma oficial de Claude y en integraciones en la nube; Anthropic destaca que el modelo tiene menor tasa de comportamientos indeseados respecto a Sonnet 4.6 y que su tokenizador actualizado cambia el coste efectivo por entrada. [Fuente: Anthropic (blog de producto)]. (anthropic.com)
Microsoft publicó que “Claude in Microsoft Foundry” ya está generalmente disponible, alojado en Azure y acelerado por sistemas NVIDIA GB300 Blackwell Ultra. La disponibilidad en Foundry facilita a equipos empresariales una vía administrada y gobernada para desplegar aplicaciones y agentes con controles de red, autenticación y facturación integrados en Azure. El anuncio es relevante para quienes construyen soluciones agentic en entornos empresariales que requieren integración con la pila Azure. [Fuente: Microsoft Azure Blog]. (azure.microsoft.com)
El resumen “What’s new” de Google Cloud incluye que Claude Sonnet 5 y otras opciones de Anthropic están disponibles en la Agent Platform, ampliando la oferta de modelos accesibles desde la plataforma de agentes de Google. Además, Google Cloud publicó la disponibilidad de la extensión Workbench Notebooks para VS Code, que permite ejecutar y conectar notebooks gestionados en la nube directamente desde el IDE, agilizando ciclos de ML y experimentación. Estas novedades facilitan el desarrollo de agentes y cargas de trabajo LLM en GCP con herramientas de productividad integradas. [Fuente: Google Cloud (What’s New)]. (cloud.google.com)
El equipo de Go publicó las notas de la versión 1.23; la actualización incluye cambios en el lenguaje (soporte ampliado para iteradores en for-range y soporte preliminar para alias de tipos genéricos), mejoras en el toolchain (nuevas banderas go env -changed, go mod tidy -diff), y una nueva telemetría opt‑in que permite enviar estadísticas de uso para mejorar la herramienta. También hay optimizaciones en el compilador y ajustes de comportamiento en time.Timer/Ticker y en manejo de certificados X.509; se recomiendan leer las notas completas antes de actualizar entornos de producción. [Fuente: Go.dev (Release Notes)]. (go.dev)
Se publicó en arXiv el trabajo “AgentBound: Verifiable Behavioral Governance for Autonomous AI Agents”, que propone un marco de gobernanza en tiempo de ejecución para supervisar y verificar el comportamiento de agentes autónomos. El artículo describe mecanismos para especificar y auditar políticas de comportamiento, con el objetivo de limitar la deriva conductual y permitir pruebas verificables de conformidad en sistemas agentic. Es relevante para equipos que diseñan infraestructura de control y auditoría para agentes en producción. [Fuente: arXiv]. (arxiv.org)
Un nuevo preprint en arXiv presenta BayesBench, un benchmark para medir cómo los LLMs actualizan sus creencias ante evidencia secuencial en conversaciones multi‑turno. BayesBench evalúa la trayectoria de creencias de modelos frente a un referente bayesiano ideal y ofrece tareas crecientes en complejidad (estimación bayesiana, predicción y predicción con framing). Los autores encuentran que los LLM actuales no siguen consistentemente actualizaciones bayesianas ideales, lo que tiene implicaciones para aplicaciones que requieren acumulación fiable de evidencia. [Fuente: arXiv]. (arxiv.org)
Un informe de prensa especializado recoge que NVIDIA habría descartado la variante quad‑die (cuatro chiplets de cómputo) del acelerador Rubin Ultra, optando por un diseño con dos chiplets por preocupaciones de manufacturabilidad y coste. La supuesta decisión reduciría la complejidad de packaging y el número de módulos HBM4E necesarios, y tendría impacto en roadmap y disponibilidad de ciertas configuraciones rack‑scale. La información proviene de reportes de la industria y fuentes anónimas; NVIDIA no publicó una confirmación pública en el anuncio. [Fuente: Tom’s Hardware]. (tomshardware.com)
TerraMaster presentó su nuevo F4‑425 Pro acompañado del sistema operativo TOS 7, que la empresa describe como “AI‑native” (control por lenguaje natural, procesamiento local para clasificación y funciones de IA). Los análisis prácticos y reseñas iniciales destacan la apuesta por interfaces conversacionales y rendimiento de red mejorado (dual 5GbE), aunque las primeras críticas señalan que el ecosistema y la madurez del software todavía deben compararse con opciones más establecidas. Es una opción a considerar para usuarios homelab que busquen integración local de funciones de IA en el NAS. [Fuente: TechRadar (reseña)]. (techradar.com)