view article Article Who Tells You Whether the Molecule Your AI Just Designed Is Any Good? FINAL-Bench • 7 days ago • 11
view article Article AX-Ray, Finding Causal-Leakage Defects in Two General-Purpose Public Models FINAL-Bench • 8 days ago • 13
view article Article Model Genome: Fingerprinting Whether an LLM Was Trained From Scratch or Derived mayafree • 13 days ago • 17
view article Article The Fast Gemma Challenge: our verified-SOTA recipe, in full FINAL-Bench • 19 days ago • 24
view article Article Aether-7B-5Attn: A 100% Open-Source Sovereign Foundation Model — and a Controlled Experiment in Heterogeneous Attention FINAL-Bench • Jul 19 • 21
view article Article VKUE: No GPU? Runs Anyway — a 34.7B Reasoner on a Laptop and on Bare CPU FINAL-Bench • Jul 12 • 17
view article Article Quantum Cryptanalysis on Real Hardware: Pushing Symmetric-Structure Key Recovery Beyond the Published Frontier FINAL-Bench • Jul 5 • 15
view article Article Chitos: From Detection to Proof — An Autonomous Security AI That Actually Exploits FINAL-Bench • Jun 29 • 19
view article Article FINAL-Bench Quantum: An Open, Neutral Benchmark for Quantum-Computing Methods FINAL-Bench • Jun 14 • 17
view article Article Training-Free Reasoning at 88.89% on GPQA Diamond: How Darwin Family Hit Frontier Scores Without a Single Gradient Step FINAL-Bench • May 15 • 18
Darwin Family: MRI-Trust-Weighted Evolutionary Merging for Training-Free Scaling of Language-Model Reasoning Paper • 2605.14386 • Published May 14 • 69