1
Evaluating calibrated refusal and safe usefulness in dual-use biology settings
一套评估智能体生物安全风险的双指标框架,兼顾性能与安全对齐,为AI治理提供量化工具。
arXiv:2607.05462v1 Announce Type: cross Abstract: As AI agents are incorporated into life science workflows, the capabilities that speed discovery mig…