Skip to content
AI Compute Radar

Glosario

VRAM vs. RAM del sistema

La VRAM es la memoria de tu tarjeta gráfica; la RAM del sistema, la de la placa base. Para la IA local la diferencia es la velocidad, no el tamaño: un modelo debe caber casi entero en la VRAM para ir rápido.

¿La VRAM es lo mismo que la RAM? No. Ambas guardan datos para un procesador, pero la VRAM está en la tarjeta gráfica y se conecta al ancho de banda de la GPU, mientras que la RAM del sistema sirve a la CPU por un camino mucho más estrecho. Añadir RAM no añade VRAM, y no se pueden intercambiar: un modelo que se sale de la VRAM funciona a la velocidad del camino lento.

Una PC tiene dos tipos de memoria. La tarjeta gráfica lleva la suya, la VRAM, pequeña pero extremadamente rápida; la placa base lleva la RAM del sistema, abundante pero mucho más lenta para esta carga de trabajo. Generar texto toca una gran parte de los pesos del modelo en cada token, así que la velocidad de generación es, en la práctica, velocidad de memoria.

Eso convierte a la VRAM en el número que decide tu clase de IA local. Las tarjetas de consumo van aproximadamente de 8 a 32 GB, y cada escalón admite un nivel mayor de modelos a velocidad cómoda. El tamaño de la RAM del sistema apenas importa para modelos que caben en la VRAM, e importa mucho en el momento en que se desbordan al offloading.

Dos notas al pie que conviene saber: las GPU de laptop suelen llevar mucha menos VRAM que las tarjetas de escritorio del mismo nombre, y Apple Silicon juega con reglas completamente distintas gracias a su memoria unificada.

Dónde lo ves en el radar

Elige tu GPU exacta en el radar y cada modelo rastreado recibe un veredicto frente a su memoria real: tamaños medidos, márgenes declarados, sin redondear hacia arriba.

Obtener veredictos para tu tarjeta

Términos relacionados

Memoria unificadaOffloadingCuantización

También en:EnglishPortuguês

← Todos los términos