Abstract page for arXiv paper 2608.25005: The Imperfective Paradox Is Not Necessarily in Large Language Models: A Benchmark Failure Before a Model Failure