Comment on Learnings from building AI agentsComments−jangletown1y"51% fewer false positives", how were you measuring? is this an internal or benchmarking dataset?
Comments
"51% fewer false positives", how were you measuring? is this an internal or benchmarking dataset?