1
GPT-RED + AgentCyberRange:AI网络安全进入「自我博弈」时代
AI安全里程碑:GPT-RED发现人类从未见过的「假思维链」攻击,AI攻防进入自我博弈时代。
AI安全里程碑:GPT-RED发现人类从未见过的「假思维链」攻击,AI攻防进入自我博弈时代。
首次提出将大模型推理过程作为攻击面,通过自适应进化生成难以察觉的思维链越狱提示,刷新AI安全攻防认知。
arXiv:2605.24497v1 Announce Type: new Abstract: Large Reasoning Models (LRMs) have demonstrated remarkable capabilities in reasoning and generation ta…
大模型思维链推理竟能被劫持?最新arXiv论文揭示了一种针对CoT环节的新型攻击范式,重塑AI安全防线。
arXiv:2510.26418v4 Announce Type: replace Abstract: Large Reasoning Models (LRMs) improve task performance through extended inference-time reasoning. …