Mejora de la Inferencia de Modelos de Lenguaje en Amazon SageMaker AI con LLM-Optimizer de BentoML

El crecimiento de los modelos de lenguaje amplios (LLMs) ha facilitado la integración de inteligencia artificial en aplicaciones mediante el uso de llamadas a API. No obstante, muchas empresas prefieren alojar sus propios modelos, a pesar de los desafíos que supone gestionar infraestructuras y el elevado costo de las GPUs. Esta tendencia se debe a […]
Presentación del Indexado SOCI en Amazon SageMaker Studio: Optimización de Tiempos de Inicio para Cargas de Trabajo de IA y ML

Amazon Web Services (AWS) ha lanzado una nueva característica para SageMaker Studio que promete revolucionar el flujo de trabajo en entornos de aprendizaje automático al presentar la indexación mediante SOCI (Seekable Open Container Initiative). Esta herramienta innovadora introduce la capacidad de carga diferida de imágenes de contenedor, lo que optimiza significativamente el tiempo de inicio […]
Desarrollo en Scala en Amazon SageMaker Studio con el Kernel Almond

El lenguaje de programación Scala se ha posicionado como una herramienta versátil, integrando enfoques orientados a objetos y funcionales, ideal para la computación distribuida y el procesamiento de grandes volúmenes de datos. Scala, al ejecutarse en la Máquina Virtual de Java (JVM), asegura una compatibilidad fluida con las bibliotecas de Java, destacándose especialmente en aplicaciones […]
Escalado Automático: Nueva Funcionalidad en Amazon SageMaker HyperPod

Amazon ha lanzado una esperada actualización en su servicio SageMaker HyperPod con la incorporación del escalado automático de nodos mediante Karpenter. Esta nueva función proporciona a las empresas la capacidad de ajustar sus clústeres de SageMaker HyperPod de manera eficiente, adaptándose a las demandas de inferencia y entrenamiento en tiempo real, cruciales en contextos de […]
Mejora la Infraestructura de ML con SageMaker HyperPod: Escalabilidad y Personalización

Amazon ha presentado SageMaker HyperPod, una innovadora infraestructura diseñada para optimizar el entrenamiento y la inferencia de modelos de aprendizaje automático (ML) a gran escala. Esta solución busca simplificar la construcción y optimización de infraestructuras de ML, reduciendo el tiempo de entrenamiento hasta en un 40%. SageMaker HyperPod permite la creación de clústeres persistentes con […]
Impulsando el Desarrollo de IA Generativa con MLflow 3.0 en Amazon SageMaker Totalmente Gestionado

Amazon ha anunciado el lanzamiento del soporte completamente gestionado para MLflow 3.0 en Amazon SageMaker, marcando un avance significativo en la optimización de la experimentación en inteligencia artificial. Esta nueva herramienta promete acelerar la transición de ideas a producción en el ámbito de la inteligencia artificial generativa, permitiendo a los desarrolladores y científicos de datos […]
Migración de Flujos de Trabajo de Detección de Fraude con Aprendizaje Automático a SageMaker de Amazon

Radial, reconocido como el proveedor líder de servicios de cumplimiento 3PL, ha dado un paso significativo hacia la revolución en la detección de fraudes a través de la modernización de sus aplicaciones de aprendizaje automático. Con una vasta experiencia de más de 30 años en la industria, la empresa proporciona soluciones integradas de pago, detección […]
Integración de NeMo Retriever Llama 3.2 en Microservicios NVIDIA NIM: Embeddings de Texto y Reordenamiento en Amazon SageMaker JumpStart

Hoy se ha anunciado con gran entusiasmo la disponibilidad del NeMo Retriever Llama 3.2 Text Embedding y Reranking como microservicios de NVIDIA NIM en Amazon SageMaker JumpStart. Esta actualización permitirá a desarrolladores implementar modelos optimizados de re-ranking y embeddings de NVIDIA, facilitando la construcción, experimentación y escalado responsable de ideas de inteligencia artificial generativa en […]
Ejecutando el framework NVIDIA NeMo 2.0 en Amazon SageMaker HyperPod: Una guía práctica

Las empresas están cada vez más enfocadas en el despliegue de capacidades de inteligencia artificial generativa, lo que ha incrementado la necesidad de contar con marcos de entrenamiento de modelos que sean tanto escalables como eficientes. En este contexto, el NVIDIA NeMo Framework se perfila como una solución integral para el desarrollo, personalización y despliegue […]
Optimización De Modelos DeepSeek-R1 Destilados Con Hugging Face TGI En Amazon SageMaker AI

DeepSeek AI, una prometedora startup en el ámbito de la inteligencia artificial, ha revolucionado el panorama del procesamiento del lenguaje con el lanzamiento de su modelo DeepSeek-R1. Este innovador modelo de lenguaje, caracterizado por un proceso de entrenamiento multietapa, supera las limitaciones de los modelos tradicionales al incorporar el aprendizaje por refuerzo como una de […]
