Explore
AI Tools
New Tools
AI Agents
One9 Worker
LLMs
RAG & Vector DBs
Research
Assemble a stack
Founder Stacks
Compare
How We Rate
About
$
/
₹
⌘K
Sign up free
Login
Back to papers
June 25, 2026
cs.CL
cs.AI
NuclearQAv2: A Structured Benchmark for Evaluating Domain-Science Competence in Large Language Models
Henry Shaowu Yuchi
,
Michal Kucer
,
Benjamin H. Sims
,
Selma Peterson
,
Emily Taylor
Original Abstract
Read on arXiv
Download PDF
Categories
cs.CL, cs.AI