Migrate LLM apps between models safely — then benchmark old vs. new to prove the upgrade. Agent skill for behavior-preserving migrations + a runnable eval harness (three-arm leaderboard, prompt sweeps). Works in Claude Code, Codex & Cursor.
-
Updated
May 29, 2026 - Python