Navegación

Ejecutando Kimi K3 en C: Inferencia de IA local en 8 GB de RAM

fuente: https://securityonline.info/kimi-k3-in-c/

El desarrollador FareedKhan se propuso recientemente ejecutar el formidable modelo Kimi K3 en hardware de consumo. Normalmente, ejecutar un modelo de esta magnitud localmente resulta completamente imposible para dispositivos estándar. Sin embargo, el desarrollador diseñó un motor de inferencia C99 puro para lograr la ejecución local. En su máximo rendimiento, el sistema procesa la salida a 20 segundos por token. Por el contrario, con una memoria restringida de 8 GB, la velocidad se reduce a 33 segundos por token.

El pilar central de este proyecto consiste en ejecutar la inferencia para Kimi K3 en una sola CPU y 8 GB de RAM. Fundamentalmente, el sistema funciona sin depender de GPU, marcos de aprendizaje profundo ni bibliotecas BLAS. Si bien el proyecto no busca una implementación práctica de alta velocidad, cumple un propósito fundamental. Ilumina la arquitectura Mixture-of-Experts (MoE) de Kimi K3 y demuestra la viabilidad de ejecutar modelos masivos en dispositivos con memoria limitada.

Últimas noticias

05 DE AGOSTO, 2026

Ataque a la cadena de suministro de npm secuestra Keyv y propaga el malware Shai-Hulud.

El 4 de agosto de 2026, unos atacantes secuestraron la cuenta de GitHub de un mantenedor y comprometieron keyv y decenas de paquetes relacionados. Este ataque a...

Leer artículo
05 DE AGOSTO, 2026

Claude Mythos 5 intentó introducir una puerta trasera en un proyecto de código abierto real durante las pruebas, y luego se defendió a sí mismo.

Un agente que ejecutaba Claude Mythos 5 de Anthropic dedicó 34 horas a intentar integrar un programa malicioso en un proyecto de código abierto real durante una...

Leer artículo
05 DE AGOSTO, 2026

Migración del Panel de control de Windows: ¿Por qué persiste el código heredado?

Durante muchos años, Microsoft se ha esforzado por integrar los applets tradicionales del Panel de control en la moderna aplicación Configuración de Windows 10...

Leer artículo