FreeToken
PulseAugur coverage of FreeToken — every cluster mentioning FreeToken across labs, papers, and developer communities, ranked by signal.
2 day(s) with sentiment data
-
FreeToken enables massive LLMs on single workstation GPUs
FreeToken is a new system designed to run extremely large language models, specifically a 753 billion parameter model, on a single workstation GPU. It achieves this by treating a personal computer as an elastic inferenc…
-
FreeToken enables large MoE models on single workstation GPUs
Researchers from UC Berkeley and UT Austin have developed FreeToken, an edge-native Mixture-of-Experts (MoE) serving engine designed to run large language models on single workstation GPUs. This system addresses the cha…
-
FreeToken system enables large MoE models on personal devices
A new serving system called FreeToken has been developed to enable the efficient execution of large Mixture-of-Experts (MoE) models on personal devices. This system dynamically adapts to heterogeneous local hardware, op…