GPT-5.6 vs. Claude Code agents

Definitely going to look into this! I just built something pretty much in the same setup (safety filters removed) have behaved the same way even on a more mundane test?