Jason Wei
Muse Spark 1.1 outperforms GPT-5.6 Sol and Gemini 3.1 on Radiology's Last Exam benchmark
Affordable health superintelligence is achievable as a north star goal
Muse Spark 1.1 achieves +5% better performance than Muse Spark 1.0 on HealthBench-Pro
Muse Spark 1.1 beats all competitor models except Fable/Mythos on HealthBench-Pro
Answering health questions is a steadily growing use case for AI