OpenAI 推出青少年版 ChatGPT,多名儿童安全专家质疑安全机制透明度
OpenAI推出青少年版ChatGPT,安全专家质疑其透明度,看AI产品如何平衡功能与责任。
IT之家 8 月 23 日消息,OpenAI 本周推出了 ChatGPT 青少年版,专门面向年轻用户,并通过年龄识别机制限制部分功能。 对此,外媒 Engadget 采访了多名儿童安全专家,他们对 ChatGPT 青少年版的评价并不一致。但所有人都认为,在向家长和年轻人推荐之前,这套系统还需要 接受…
OpenAI推出青少年版ChatGPT,安全专家质疑其透明度,看AI产品如何平衡功能与责任。
IT之家 8 月 23 日消息,OpenAI 本周推出了 ChatGPT 青少年版,专门面向年轻用户,并通过年龄识别机制限制部分功能。 对此,外媒 Engadget 采访了多名儿童安全专家,他们对 ChatGPT 青少年版的评价并不一致。但所有人都认为,在向家长和年轻人推荐之前,这套系统还需要 接受…
OpenAI升级零数据留存,API客户数据更安全,为IPO筑牢信任基石,企业级AI合规必看。
IT之家 8 月 20 日消息,OpenAI 公司今天(8 月 20 日)发布博文,宣布面向符合资格的前沿模型 API 客户,扩展“零数据留存”(Zero Data Retention)服务, 自动化系统可识别跨交互风险模式。 IT之家援引博文介绍,OpenAI 公司强调请求处理完成后,不保留提示词…
Hugging Face泄露敲响警钟,OpenAI紧急升级内部安全标准,AI风险防控进入新阶段。
The new safeguards include more detailed monitoring of models during the development process, as well as greater emphasis on alignment and security du…
微软强化激活安全,TPM硬件证明封堵KMS盗版路径,企业需关注部署变化。
IT之家 7 月 26 日消息,在推出 Windows 11 后,微软要求整个 PC 产业将可信平台模块(TPM)作为所有新主板和处理器的标准配置。如今,微软正进一步利用这一已广泛普及的硬件,加强企业市场 Windows 的激活安全机制。 微软近日宣布,将为 Windows 批量激活服务(KMS,K…
新方法可绕过苹果macOS安全机制,虽然实施门槛高但威胁严重,值得关注。
IT之家 7 月 25 日消息,科技媒体 AppleInsider 昨日(7 月 24 日)发布博文, 报道称研究人员发现了一种方法,可以绕过苹果 macOS 的安全机制并运行恶意软件。 IT之家援引博文介绍,该方法实施门槛相对较高,需要满足以下 3 个条件: 用户已在 Mac 设备下载并安装应用 …
LLM代理的隐私泄露新解法:SlotGuard 提出槽位守卫机制,精准屏蔽凭证与本地上下文,避免过度编辑。
arXiv:2607.17147v1 Announce Type: cross Abstract: LLM agents can leak privacy (e.g., paths, emails) and credentials (e.g., API keys) as agent observat…
蚂蚁集团副总裁陈亮指出智能体越强信任风险越大,原生安全与“换挡式”编排调度机制成关键。
IT之家 7 月 19 日消息,2026 世界人工智能大会今天在上海举行。据新浪科技消息,蚂蚁集团副总裁、蚂蚁大安全 CTO 陈亮认为, 智能体(Agent)正在成为 AI 时代的新型操作系统 , 需要一套与之相匹配的信任基座 。 据悉,蚂蚁集团为此提出了“原生安全”和“可信互联”两个方向的智能体信…
通过签名协议与实时配额监控,确保AI编码代理安全交接,防止重复操作与资源滥用,工程实践性强。
Building a signed handoff protocol for AI coding agents If you run more than one AI coding agent, you've hit this: Claude Code (or Codex, or whichever…
GitHub官方揭秘如何为每个仓库赋予「持久所有者」,解决代码所有权丢失的安全隐患
GitHub had over 14,000 repositories. Fewer than half had clear ownership. Here's how we gave every active repository a validated owner in under 45 day…
为LLM智能体动作引入后果感知的准入预检,降低误操作风险,值得安全方向团队研读
Article URL: https://github.com/gfernandf/agent-skills/blob/main/docs/ACTION_PREFLIGHT_FORECAST_QUICKSTART.md Comments URL: https://news.ycombinator.c…
AI安全机制为何把本地HTML误判成网络袭击?看大模型「智障」瞬间,笑中带思。
欢迎来到《大模型的“智障”瞬间》系列专栏。今天我们要聊的第14个弱智之处,堪称大模型安全机制中的“无厘头巅峰”—— AI的本地安全被害妄想症 。 如果你是一个开发者、效率工具爱好者,或者仅仅是一个喜欢折腾电脑的普通用户,你大概率会自己写一个、或者在网上找一个本地的 HTML 网页。这个网页可能是一个…
揭示嵌入防御在LLM多代理系统中的根本性失效,提出安全范式新思考
arXiv:2605.01133v2 Announce Type: replace-cross Abstract: Large language model (LLM)-powered multi-agent systems (MAS) enable agents to communicate an…
用非洲低资源语言玩多轮对话,成功绕过ChatGPT、Gemini等主流大模型的安全护栏,安全漏洞新发现。
arXiv:2605.18239v1 Announce Type: new Abstract: Large Language Models (LLMs) remain vulnerable to jailbreak attempts that circumvent safety guardrails…