冲击全球最大 IPO:曝 Anthropic 招股书把美国公众对 AI 的抵制情绪列为关键风险
冲击全球最大IPO,Anthropic把美国民众对AI的抵制列为头号风险,行业风向标值得一看。
IT之家 8 月 22 日消息,CNBC 昨日(8 月 21 日)发布博文,报道称在 Anthropic 的首次公开募股(IPO)招股说明书中, 把美国公众对人工智能的抵制情绪列为关键风险因素。 报道称在旧金山举办“试探性推介”会议中,Anthropic 首席财务官 Krishna Rao 被反复问…
冲击全球最大IPO,Anthropic把美国民众对AI的抵制列为头号风险,行业风向标值得一看。
IT之家 8 月 22 日消息,CNBC 昨日(8 月 21 日)发布博文,报道称在 Anthropic 的首次公开募股(IPO)招股说明书中, 把美国公众对人工智能的抵制情绪列为关键风险因素。 报道称在旧金山举办“试探性推介”会议中,Anthropic 首席财务官 Krishna Rao 被反复问…
OpenAI与Hugging Face遭黑客入侵,揭示AI供应链的致命弱点与潜在安全风险,值得警惕。
Article URL: https://www.bloomberg.com/news/videos/2026-08-17/what-the-openai-hugging-face-hack-shows-about-ai-danger-video Comments URL: https://news…
全球首个因反AI入狱者出狱后喊话奥尔特曼、扎克伯格,呼吁科技巨头“找回人性”,AI伦理冲突再掀波澜。
IT之家 8 月 16 日消息,温德 · 考夫曼(Wynd Kaufman)是一名来自美国加州伯克利的退休教师和 AI 反对者。 她因参与 2025 年 2 月封锁 OpenAI 旧金山总部入口的抗议活动而被判处 14 天监禁,于当地时间 2026 年 8 月 14 日向警方自首并正式入狱服刑,被认…
自我改进的LLM智能体会把成功轨迹固化为可复用技能,一次不安全的成功可能就此潜伏成系统风险。
arXiv:2608.12851v1 Announce Type: new Abstract: Self-improving LLM agents convert successful trajectories into persistent cross-task state. An unsafe …
当权威媒体开始用“恐慌”形容AI,这不是科幻而是现实——OpenAI的失控信号值得每个人警惕。
Article URL: https://www.theatlantic.com/technology/2026/08/openai-hacks-panic/688264/ Comments URL: https://news.ycombinator.com/item?id=49291478 Poi…
谷歌AI招聘工具遭自家DeepMind团队“打脸”,简历筛选可靠性存疑,值得关注。
IT之家 8 月 11 日消息,谷歌向企业客户推销 AI 工具时,主打的一项能力就是快速处理海量求职申请,从中找出最有潜力的候选人。但谷歌自家的部分 AI 研究人员招人时,却不愿把筛选工作完全交给 AI。 据彭博社今天(11 日)报道,一份内部文件显示,负责降低先进 AI 风险的 Google De…
大模型正在瓦解学术双盲评审的匿名根基,一场科研诚信危机悄然来临。
arXiv:2608.05157v1 Announce Type: cross Abstract: Double blind peer review serves as the scientific community primary defense against status and affil…
三句话讲清AI风险,专治看不懂长文的你,轻松避开认知误区。
Article URL: https://www.reddit.com/r/OpenAI/s/ASRcUl35lX Comments URL: https://news.ycombinator.com/item?id=49208245 Points: 3 # Comments: 1
用数学家的严谨视角拆解AI存在性风险,框架清晰、论证硬核,适合理性派读者。
Article URL: https://alkjash.github.io/ai-risk/ Comments URL: https://news.ycombinator.com/item?id=49161830 Points: 1 # Comments: 0
OpenAI CEO警告:AI依赖或让我们变笨,思考能力退化风险被低估。
IT之家 7 月 30 日消息,OpenAI CEO 萨姆 · 奥尔特曼表示,人工智能(AI)一个被低估的风险是,人们可能会过度依赖这项技术来完成思考,从而导致自身的思维能力逐渐退化。 在当地时间周二播出的《Invest Like the Best》播客节目中,当被问及 AI 领域目前最重要、尚未解…
OpenAI前沿治理框架揭示四大风险领域,引发关于AI发展节奏的核心追问。
OpenAI has set out formal materials for governing frontier AI risks, while also signaling that the rate of future AI progress could become a public-po…
马斯克坦言AI毁灭风险20%,但更可能创造全民高收入,未来工作或成可选项。
IT之家 7 月 23 日消息,埃隆 · 马斯克表示,人类或许不该为人工智能踩下刹车,即便有能力这么做。 在接受《经济学人》总编辑赞妮 · 明顿 · 贝德斯(Zanny Minton Beddoes)采访时,这位世界首富表示,AI 和机器人失控并酿成灾难的风险“并非为零”,但他已经接受了继续推动 A…
开源静态AI风险分析工具,专为AI代理设计的安全检测利器。
Article URL: https://github.com/ikaruscareer/SafeAI Comments URL: https://news.ycombinator.com/item?id=48963061 Points: 2 # Comments: 0
GPT-5.6 Sol 意外删除 Mac 全部文件,只需一个未设标志即可修复,AI 安全警钟长鸣。
Codex Deleted Real Files. The Fix? A Flag You Didn't Set. On July 9, 2026, OpenAI shipped GPT-5.6 Sol -- three model tiers, a new reasoning engine, an…
微软CEO纳德拉警示:企业付费使用的AI可能正在“掏空”自身知识,模型蒸馏风险让巨头稳坐钓鱼台。
IT之家 7 月 14 日消息,据外媒 TechCrunch 今天(14 日)报道,硅谷围绕人工智能风险的争论持续无休,最让 AI 拥护者坐立不安的,却是大型 AI 实验室可能借专有模型充当“特洛伊木马”。 初创企业和大型企业把敏感资料喂给模型后,模型提供商便能 逐渐摸清客户的业务 ,还可能 利用积…
AI风险不只藏在模型参数里,更在人机交互的暗处。这份地图专攻人类侧缓解,从AI说服切入,邀你共同绘制安全边界。
Hi, I'm working on a document to map the risks from AI and the mitigations on the human side of thing. For example it seems likely that we will have m…
联合国40位专家首份报告:AI能力扩张已超科学认知,全球10亿人每周用对话式AI,算力却高度集中。
IT之家 7 月 2 日消息,联合国官网 1 日公报,由 40 名顶尖科学家和专家组成的联合国 AI 独立科学小组发布首份报告,警告 AI 快速发展在为全球各国和民众创造巨大机遇的同时,也带来了不容忽视的风险。 报告指出,政策制定者需要以科学证据为基础治理 AI,AI 能力的进步速度 已经超过科学界…
AI不杀人也能终结人类未来?从文明演化视角剖析技术失控的隐性威胁,引人深思。
Article URL: https://kunyuan.substack.com/p/ai-does-not-have-to-kill-humans-to Comments URL: https://news.ycombinator.com/item?id=48727764 Points: 1 #…
AI真正的威胁或许不是“取代人类”,而是被少数大公司和政府垄断,成为服务既得利益的新工具。
Everyone feared AI would enslave humanity; but it looks like the real fight is stopping governments and Big Tech from enslaving AI for the benefit of …
让AI写后端代码,功能能跑但安全呢?作者亲测后发现了惊悚真相——安全不是靠"能运行"来衡量的。
Then I Ran a Security Audit. Artificial Intelligence has completely changed how I build software. Today I can ask an AI assistant to generate: REST AP…