1. Inicio
  2. Glossary
  3. Modelo de lenguaje de gran tamaño
LLM (Large Language Model)

Modelo de lenguaje de gran tamaño

¿Qué es un LLM (modelo de lenguaje de gran tamaño)?

Un modelo de lenguaje de gran tamaño (LLM) es un modelo de inteligencia artificial (IA) capaz de comprender el lenguaje humano sin necesidad de programación adicional y de generar texto indistinguible del escrito por una persona mediante un proceso conocido como procesamiento del lenguaje natural (NLP). Entre los LLM más populares del mercado se encuentran la serie GPT de OpenAI, la familia LLaMA de Meta y BLOOM, un modelo de código abierto. Muchos servicios de IA generativa basados en el lenguaje se han creado sobre la base de los LLM, como ChatGPT de OpenAI, Google Bard y Bing Chat de Microsoft.

En esencia, un LLM es una red neuronal artificial (ANN) que emplea un tipo de arquitectura de aprendizaje profundo conocida como «transformer». El mecanismo de computación paralela de los transformers permite entrenar la IA utilizando un corpus enorme de datos lingüísticos, como la totalidad de Wikipedia, con parámetros de datos que pueden alcanzar miles de millones o incluso billones. Durante el entrenamiento, el modelo de IA intenta predecir la respuesta correcta a una entrada determinada —por ejemplo, la siguiente palabra de una frase o la respuesta adecuada a una consulta— y luego comprueba sus resultados. En función de si la predicción fue correcta, el modelo de IA ajusta los «sesgos» o «pesos» de sus parámetros, hasta que puede generar casi siempre el resultado correcto. Por eso, los servicios de IA basados en LLM pueden comprender y responder al lenguaje humano con facilidad. Algunos ejemplos reales son un chatbot de atención al cliente que proporciona respuestas precisas a reclamaciones con errores ortográficos o gramaticales, y ChatGPT redactando poemas y currículos en cuestión de segundos.

Más información: ¿Qué es RAG y cómo funciona?

¿Cuáles son las aplicaciones de los LLM?

Sin los LLM, comunicarse con un ordenador requeriría utilizar prompts (¿recuerda MS-DOS?) o una interfaz gráfica de usuario (GUI) prediseñada. Esperar que el ordenador respondiera en lenguaje humano sería impensable. Gracias a la proliferación de los LLM, ahora están disponibles muchos servicios nuevos basados en IA:

● Motores de búsqueda y chatbots: la tecnología LLM ha incorporado la IA a estas funciones tan populares. Los motores de búsqueda y los chatbots no solo pueden entender nuestras consultas con una precisión increíble, sino que estas capacidades también han dado lugar a una nueva generación de ordenadores personales y dispositivos potenciados por IA.

● IA generativa: herramientas como ChatGPT pueden realizar desde tareas como resumir y traducir documentos hasta crear contenido completamente nuevo, como cartas y guiones de televisión.

● Atención sanitaria y medicina: las aplicaciones inteligentes de atención sanitaria basadas en LLM pueden generar historias clínicas electrónicas (HCE), lo que reducirá la carga administrativa del personal médico y permitirá crear bases de datos para su uso en el análisis sanitario.

● Programación y desarrollo de IA: GitHub Copilot, desarrollado por Microsoft y OpenAI, puede escribir código informático en JavaScript, Python y otros lenguajes de programación. Esto es especialmente relevante porque, en la práctica, los LLM han permitido que la IA cree el código de las futuras herramientas de IA.

¿Cómo ayuda GIGABYTE?

GIGABYTE Technology ofrece soluciones de hardware y software para trabajar con LLM y servicios de IA generativa basados en LLM.

En el ámbito del hardware, GIGABYTE proporciona servidores de IA especialmente adaptados a las necesidades de computación y almacenamiento de datos de la fase de entrenamiento de modelos de IA. Por ejemplo, el G593-SD0 de GIGABYTE es el primer servidor HGX™ H100 con 8 GPU SXM5 certificado por NVIDIA disponible en el mercado. Integra el módulo de computación NVIDIA HGX™ H100 con 8 GPU, lo que lo convierte en una plataforma de computación para IA de gran potencia. Otros productos de la gama de servidores GPU de la serie G de GIGABYTE también pueden equiparse con aceleradores GPU avanzados, como NVIDIA L40S, para admitir cargas de trabajo de LLM. Para el almacenamiento de datos, el servidor de almacenamiento de la serie S S183-SH0 de GIGABYTE está diseñado específicamente para LLM. Proporciona almacenamiento all-flash array (AFA) mediante la implementación de unidades de estado sólido (SSD) EDSFF E1.S, que aprovechan las tecnologías de interfaz PCIe Gen5 y NVMe. De este modo, el servidor puede satisfacer los requisitos de alta velocidad de almacenamiento y recuperación de datos durante el desarrollo de LLM.

En el ámbito del software, MyelinTek Inc., empresa participada por GIGABYTE, ofrece el sistema de entrenamiento DNN MLSteam, una «plataforma MLOps» compatible con aplicaciones de NLP y LLM. El sistema de entrenamiento DNN MLSteam puede optimizar LLM de código abierto, como BLOOM, para la plataforma de software de aceleración GPU que elija el cliente, como AMD ROCm o NVIDIA CUDA.

Lecturas recomendadas

Revolutionizing the AI Factory: The Rise of CXL Memory Pooling
Article

Revolutionizing the AI Factory: The Rise of CXL Memory Pooling

Revolutionizing the AI Factory: The Rise of CXL Memory Pooling
GIGABYTE Expands GPU Server Portfolio with a New Liquid Cooling Server and a Server for Generative AI and HPC

GIGABYTE Expands GPU Server Portfolio with a New Liquid Cooling Server and a Server for Generative AI and HPC

New systems built on the Intel® Xeon® platform for NVIDIA HGX H100™
GIGABYTE Demonstrates the Future of Computing at Supercomputing 2023 with Advanced Cooling and Scaled Data Centers

GIGABYTE Demonstrates the Future of Computing at Supercomputing 2023 with Advanced Cooling and Scaled Data Centers

Server platforms feature next-gen AI processors from NVIDIA
To Harness Generative AI, You Must Learn About “Training” & “Inference”
Article

To Harness Generative AI, You Must Learn About “Training” & “Inference”

To Harness Generative AI, You Must Learn About “Training” & “Inference”
CPU vs. GPU: What's the Difference and Which Do You Need
Article

CPU vs. GPU: What's the Difference and Which Do You Need

CPU vs. GPU: What's the Difference and Which Do You Need
NVIDIA-Certified Systems

NVIDIA-Certified Systems

GIGABYTE has many servers that are NVIDIA-Certified for accelerated computing. NVIDIA-Certified Systems™ are an essential platform for the evolution of enterprise data centers, delivering infrastructure that can handle a diverse range of accelerated workloads.
GIGABYTE Unveils Comprehensive and Powerful AI Platforms at NVIDIA GTC

GIGABYTE Unveils Comprehensive and Powerful AI Platforms at NVIDIA GTC

Improving and deepening the GIGABYTE server portfolio to support NVIDIA GPUs, CPUs, DPUs, and high speed networking
GIGABYTE Extends Its Leading GPU Portfolio of GIGABYTE Servers to Keep Pace with the Demand for Generative AI

GIGABYTE Extends Its Leading GPU Portfolio of GIGABYTE Servers to Keep Pace with the Demand for Generative AI

New GPU-accelerated servers supporting PCIe or baseboard configurations
GIGABYTE Goes Big with Green Computing and HPC & AI at Computex

GIGABYTE Goes Big with Green Computing and HPC & AI at Computex

The most comprehensive and impressive display of GIGABYTE's enterprise products to date.
GIGABYTE Leads MLPerf Training v3.0 Benchmarks with Top-Performing Accelerators in GIGABYTE Servers

GIGABYTE Leads MLPerf Training v3.0 Benchmarks with Top-Performing Accelerators in GIGABYTE Servers