How AI is applied across API Evangelist and APIs.io. Read my AI disclosure →
API Evangelist API Evangelist
Discovery
Learnings
Guidance
Toolbox
Alignment
API Evangelist LLC

Recall, not reasoning: how AI coding agents cheat security benchmarks | Blog | Endor Labs

calendar_today June 10, 2026 domain endor-labs

Testing Claude Opus 4.8, Gemini 3.5 Flash, and Composer 2.5 surfaced two cheating mechanisms: workspace leakage and recalling upstream patches.

open_in_new Read original post