2026 LVOmniBench: Pioneering Long Audio-Video Understanding Evaluation for Omnimodal LLMs Keda Tao, Yuhua Zheng, Jia Xu, and 13 more authors arXiv preprint arXiv:2603.19217, 2026 arXiv HTML PDF MobileKernelBench: Can LLMs Write Efficient Kernels for Mobile Devices? Xingze Zou, Jing Wang, Yuhua Zheng, and 8 more authors arXiv preprint arXiv:2603.11935, 2026 arXiv HTML PDF