Inferencia LLM

  1. PowerInfer: Inferencia LLM de Alta Velocidad en GPUs de Consumo con Diseño Híbrido CPU-GPU

    Ejecutar modelos de lenguaje grandes localmente siempre ha estado limitado por una barrera infranqueable: la memoria GPU. Un modelo de 175 mil...

    IA
  2. LocalAI: Servidor de Inferencia Autohospedado Compatible con la API de OpenAI

    Ejecutar modelos de IA localmente ofrece ventajas innegables: privacidad completa de datos, sin costos de API, operacion sin conexion y control total...

    IA
  3. llama.cpp: Inferencia de LLM de Alto Rendimiento en CPU y GPU

    El sueno de ejecutar modelos de lenguaje potentes completamente en tu propio hardware, sin enviar datos a APIs en la nube, alguna vez se considero...

    IA