This has largely been shown to be false. Claude performs better outside of Claude Code, for example.
Some models are just better at using tools than others.