TY - RPRT TI - BaziQA-Benchmark: Evaluating Symbolic and Temporally Compositional Reasoning in Large Language Models AU - Jiangxi Chen AU - Qian Liu PY - 2026 UR - https://arxiv.org/abs/2602.12889 ID - 2602.12889 ER -