LocalsOnlyevaluationsHow to read this

WELCOME TO THE LOCAL SIDE

Small machines.
Big possibilities.

A little desk space. A lot to discover. We put local AI through its paces on real hardware, so you can find the right model for your own corner of the world.

Serious tests. Room to play.

YOUR DESK
IS THE LAB
A whimsical home lab with a smiling lavender monitor, mini computer, compact server, plants, coffee, and a sleeping cat.

FRESH FROM THE BENCH

Qwen 3.8 27B

GB10 · 128GB · UD-Q4_K_XL

Explore this setup ↗
Latest · IFBench42.3%2026-09-08
Benchmarks tested61,037 scored trials

Leaderboard

Explore the tests ↗
15 results · Scientific reasoningScoring & protocols ↗
Model / setupRuns onEvidence
GPT-6 AstraOpenAI evaluation96.0%Cloud / APIPublished
Gemini 3.8 FlashOpenAI comparison95.3%Cloud / APIPublished
GPT-5.6 SolOpenAI evaluation94.6%Cloud / APIPublished
Gemini 3.1 Pro PreviewGoogle DeepMind evaluation94.3%Cloud / APIPublished
Gemini 3.1 Pro PreviewOpenAI comparison94.3%Cloud / APIPublished
Claude Fable 5.1OpenAI comparison93.7%Cloud / APIPublished
Claude Opus 5OpenAI comparison93.7%Cloud / APIPublished
Claude Opus 4.8Anthropic system card93.6%Cloud / APIPublished
GPT-5.6 TerraOpenAI evaluation92.9%Cloud / APIPublished
Claude Fable 5OpenAI comparison92.6%Cloud / APIPublished
GPT-5.6 LunaOpenAI evaluation92.3%Cloud / APIPublished
GLM-5.3-Flash NVFP4NVIDIA evaluation92.1%UnspecifiedPublished
Claude Opus 4.8OpenAI comparison92.0%Cloud / APIPublished
Qwen 3.8 27BBF16 reference89.2%UnspecifiedPublished
Qwen 3.8 27BUD-Q4_K_XL73.2%LocalGB10 · 128GBMeasured

Reported scores; setups and evaluation protocols differ. How to compare ↗