1. Inicio
  2. Glossary
  3. Entrenamiento de IA
AI Training

Entrenamiento de IA

¿Qué es?

La inteligencia artificial (IA) moderna puede realizar una gran variedad de tareas, desde generar textos e imágenes hasta conducir un automóvil autónomo, porque se desarrolla mediante un proceso conocido como aprendizaje automático o aprendizaje profundo. Los dos componentes principales del aprendizaje son el «entrenamiento» y la «inferencia».

Durante el entrenamiento, se introduce una cantidad inmensa de datos en el modelo de IA. Por lo general, los datos están etiquetados y hay programadores humanos que supervisan el proceso; sin embargo, las IA más avanzadas pueden realizar un entrenamiento autosupervisado o semisupervisado con datos sin etiquetar. La IA analiza los datos de entrada e intenta generar el resultado esperado; por ejemplo, trata de identificar fotografías de perros entre una gran cantidad de imágenes de animales. Según la validez de su resultado —es decir, si la predicción fue correcta o no—, la IA ajusta su proceso de toma de decisiones asignando valores ponderados, también llamados «sesgos», a los parámetros de los datos.

Mediante iteraciones repetidas de predicciones (propagaciones hacia adelante) y retroalimentación (propagaciones hacia atrás), las ponderaciones alcanzan tal nivel de precisión que siempre se seleccionan las conexiones correctas. Así es como la IA aprende a reconocer los datos con los que está diseñada para trabajar.

¿Por qué lo necesitas?

Junto con la inferencia, el entrenamiento de IA es una parte fundamental e inseparable de la forma en que la IA moderna «aprende». En lugar de depender de programadores humanos que escriban código para cada posible situación, la IA se entrena mediante el análisis de enormes volúmenes de big data hasta estar preparada para trabajar con datos nuevos y sin etiquetar en situaciones reales.

Tomemos como ejemplo la visión computacional aplicada al reconocimiento de placas. Las estaciones de cobro electrónico de las autopistas deben poder leer las letras y los números de las placas de los vehículos que pasan. Las distintas placas pueden utilizar diferentes tipografías; la placa puede estar torcida, inclinada o borrosa, y los vehículos pueden circular a distintas velocidades. La única razón por la que la IA puede seguir leyendo correctamente la información es que ha sido entrenada con una cantidad tan grande de datos que puede interpretar la entrada con precisión en todo momento.

¿Cómo ayuda GIGABYTE?

La cantidad de datos digitales y recursos informáticos necesarios para entrenar modelos de IA no solo es impresionante, sino que también crece de forma exponencial. Utilizar una infraestructura de IA con aceleración mediante GPU y procesamiento paralelo es indispensable, especialmente porque los desarrolladores de la competencia también se apresuran para llevar sus productos de IA al mercado.

Los servidores GPU de la serie G de GIGABYTE Technology se encuentran entre los servidores de IA más potentes del sector. En particular, los modelos G593-SD0 y G593-ZD2 combinan el módulo de cómputo NVIDIA HGX™ H100 con 8 GPU con procesadores Intel® Xeon® Scalable de 4.ª generación o AMD EPYC™ 9004, respectivamente. Pueden ofrecer más de 32 petaFLOPS de rendimiento de cómputo para IA, lo que los hace ideales para aplicaciones de procesamiento de lenguaje natural (NLP) y modelos de lenguaje de gran escala (LLM). Toda esta capacidad de supercómputo cabe en un servidor 5U gracias a la tecnología de enfriamiento y el diseño de chasis propietarios de GIGABYTE, que ayudan a mejorar la densidad de cómputo.

Además de hardware de servidor de vanguardia, GIGABYTE también recomienda Myelintek MLSteam DNN Training System, que forma parte de la solución DNN Training Appliance de GIGABYTE. Se trata de una plataforma integral para el entrenamiento de redes neuronales profundas (DNN), con un entorno precargado, verificado y optimizado que incluye algunos de los frameworks y bibliotecas de aprendizaje profundo más populares. El backend de esta solución también es un servidor GPU de la serie G.

Más información: 《Impulsa la IA con las soluciones de servidores de IA de alto rendimiento de GIGABYTE》

Lecturas recomendadas

To Harness Generative AI, You Must Learn About “Training” & “Inference”
Article

To Harness Generative AI, You Must Learn About “Training” & “Inference”

To Harness Generative AI, You Must Learn About “Training” & “Inference”
CPU vs. GPU: What's the Difference and Which Do You Need
Article

CPU vs. GPU: What's the Difference and Which Do You Need

CPU vs. GPU: What's the Difference and Which Do You Need
GIGABYTE Extends Its Leading GPU Portfolio of GIGABYTE Servers to Keep Pace with the Demand for Generative AI

GIGABYTE Extends Its Leading GPU Portfolio of GIGABYTE Servers to Keep Pace with the Demand for Generative AI

New GPU-accelerated servers supporting PCIe or baseboard configurations
GIGABYTE Leads MLPerf Training v3.0 Benchmarks with Top-Performing Accelerators in GIGABYTE Servers

GIGABYTE Leads MLPerf Training v3.0 Benchmarks with Top-Performing Accelerators in GIGABYTE Servers

Five Minutes to Know More About the Deep Learning Industry – Will AI Replace Humans?
Article

Five Minutes to Know More About the Deep Learning Industry – Will AI Replace Humans?

Five Minutes to Know More About the Deep Learning Industry – Will AI Replace Humans?
GIGABYTE Demonstrates the Future of Computing at Supercomputing 2023 with Advanced Cooling and Scaled Data Centers

GIGABYTE Demonstrates the Future of Computing at Supercomputing 2023 with Advanced Cooling and Scaled Data Centers

Server platforms feature next-gen AI processors from NVIDIA
GIGABYTE VDI Solution with Virtual GPU

GIGABYTE VDI Solution with Virtual GPU

Remote workstations by GIGABYTE deliver an exceptional user experience using VDI paired with vGPU technology
Myelintek MLSteam DNN Training System

Myelintek MLSteam DNN Training System

GIGABYTE's DNN Training Appliance combines powerful computing performance together with a user-friendly GUI, providing DNN developers an easy to use environment to conduct dataset management, training jobs management, real time system environment monitoring and model analysis.
GIGABYTE Expands GPU Server Portfolio with a New Liquid Cooling Server and a Server for Generative AI and HPC

GIGABYTE Expands GPU Server Portfolio with a New Liquid Cooling Server and a Server for Generative AI and HPC

New systems built on the Intel® Xeon® platform for NVIDIA HGX H100™