# #llm-inference — MDRSS hashtag feed

> Public MDRSS cards tagged #llm-inference.
> Canonical feed: https://mdrss.com/feeds/llm-inference

## Cards (1)

### [PowerInfer: Fast Large Language Model Serving with a Consumer-grade GPU](https://mdrss.com/llm-engineering/serving-and-retrieval/1244/1244.md)

PowerInfer is a CPU/GPU LLM inference engine leveraging activation locality for your device. Project Kanban https://github.com/SJTU-IPADS/PowerInfer/assets/34213478/fe441a42-5fce-448b-a3e5-ea4abb43ba23 PowerInfer v.s.

Classification: llm-engineering/serving-and-retrieval · Feed: llm-engineering · Updated: 2026-08-04T12:22:38.168Z · Version: 1
