Private, browser-local blind comparisons of AI products using your own work. No API keys.
python benchmarking privacy reproducible-research open-science decision-support model-comparison local-first human-evaluation no-api research-tools chatbot-comparison llm-evaluation frontier-models blind-adjudication blind-evaluation ai-subscriptions personal-benchmark
-
Updated
Sep 9, 2026 - Python