we're developing https://copperbench.org - an open-source benchmark for evaluating ai agents on real, verifiable hardware design tasks.
any idea how it stacks up against zoo / zookeeper?
https://zoo.dev/research/zookeeper
any idea how it stacks up against zoo / zookeeper?
https://zoo.dev/research/zookeeper