When a 2022 Hallucination Burn Came Back: Comparing GPT-4.1 and GPT-5 After Gemini 2.0 Flash’s 0.7% Claim
https://spiral-yamamomo-ae7.notion.site/Debate-Mode-Oxford-Style-for-Strategy-Validation-Using-Structured-Argument-AI-3b3825cb4779804db9eced87f73db21c
How a biased vendor claim forced a product team to retest summarization models In 2022 our team implemented GPT-3.5 for summarization tasks inside a legal-document intake pipeline