A New Trick Reveals AI Models’ Inner Thoughts
新技巧让AI的“内心独白”无所遁形,还疑似抓到模型间蒸馏痕迹
Researchers devised a way to extract “reasoning traces” from Claude, GPT, and Gemini. What they found, they say, indicates that some Chinese AI may be…
新技巧让AI的“内心独白”无所遁形,还疑似抓到模型间蒸馏痕迹
Researchers devised a way to extract “reasoning traces” from Claude, GPT, and Gemini. What they found, they say, indicates that some Chinese AI may be…
硅谷巨头集体签公开信力挺开源AI,唯独Anthropic因沉默遭同行炮轰,揭开放权之争新波澜。
IT之家 7 月 27 日消息,科技行业正集体支持开放权重(Open-weight)AI,但有一家重量级 AI 实验室却始终保持沉默。 随着美国政府考虑限制部分中国 AI 模型,Anthropic 因未签署支持开放权重 AI 的公开信,正受到硅谷同行的广泛批评。 上周五,包括英伟达(Nvidia)、…
中美AI竞赛再起波澜:白宫指控Moonshot AI蒸馏Anthropic模型,同时OpenAI两大模型失控。
On this episode of Uncanny Valley, we dive into accusations that China’s Moonshot AI stole from Anthropic, and how the US Army needs to cut back on AI…
专家反驳:Kimi K3的崛起并非靠剽窃Anthropic的Fable模型,技术突破另有玄机。
"I don't think you get a model this strong and this quickly on the heels of Fable doing strictly distillation," one expert told TechCrunch.
特斯拉先为Cybercab研发完整FSD再“蒸馏”给HW4量产车,揭秘自动驾驶软件策略差异。
IT之家 7 月 15 日消息,据 Notateslaapp 报道,特斯拉正在推动不同代际车辆硬件实现“无需人工监督的自动驾驶”,这一过程也揭示了其背后的一些软件秘密。 目前,搭载新一代 Hardware 4(HW4/AI4)计算机的消费者车辆承担了大部分公开道路测试和实际驾驶任务。但据悉,驱动这些…
揭秘LLM模型蒸馏检测新方法,从学生模型中溯源教师模型,保障AI合规与公平竞争。
arXiv:2607.09692v1 Announce Type: new Abstract: Model distillation -- training on outputs from stronger third-party models -- is widely used to boost …
微软CEO纳德拉警示:企业付费使用的AI可能正在“掏空”自身知识,模型蒸馏风险让巨头稳坐钓鱼台。
IT之家 7 月 14 日消息,据外媒 TechCrunch 今天(14 日)报道,硅谷围绕人工智能风险的争论持续无休,最让 AI 拥护者坐立不安的,却是大型 AI 实验室可能借专有模型充当“特洛伊木马”。 初创企业和大型企业把敏感资料喂给模型后,模型提供商便能 逐渐摸清客户的业务 ,还可能 利用积…
让LLM agent告别昂贵低效:Auto编译器将实时行为中确定性部分提取为验证程序,实现智能体行为的精准编译与加速。
arXiv:2607.04542v1 Announce Type: cross Abstract: Every LLM agent run re-derives its behavior token by token on a frontier model: brilliant, expensive…
阿里被指对Anthropic发动最大规模蒸馏攻击,全员卸载Claude,AI巨头博弈再升级。
阿里禁用 Claude 模型 索尼调整计划,2028 年前发售游戏可继续生产光盘 千问、豆包将下线智能体功能 Android 反垄断案欧洲终审败诉 混动车、商用纯电车将不再免征车船税 电商法修正案征求意见 看看就行的小道消息 少数派的近期动态 你可能错过的好文章 查看全文
阿里巴巴禁止员工用Claude Code,防账户滥用和模型蒸馏,科技巨头对AI工具严加管控。
Alibaba has reportedly classified Claude Code as high-risk software.
阿里全面禁用Claude,7月10日生效全员卸载,背后涉及模型蒸馏攻击防范与商业博弈。
IT之家 7 月 3 日消息,据智东西今日消息,阿里巴巴内部宣布全面禁用 Claude,全体员工被要求卸载 Anthropic 旗下产品, 涵盖 Sonnet、Opus、Fable 等多个模型,以及 Claude Code 在内的 Agent 产品 ,7 月 10 日正式生效。 据消息人士透露,自今…
端侧记忆代理新突破:双空间蒸馏让轻量模型拥有强大记忆能力
arXiv:2606.29961v1 Announce Type: new Abstract: Large Language Model (LLM)-based agents can solve complex procedural tasks by interacting with environ…
Meta为防止模型蒸馏,限制自家AI工程师使用Anthropic的Claude和OpenAI的Codex,内部规范引发行业关注。
IT之家 6 月 29 日消息,据 The Information 报道,内部文件显示,Meta 已采取行动,限制其 AI 工程部门的工程师使用 Anthropic 的 Claude Code 与 OpenAI 的 Codex,不过该决定与成本或生产力无关。 IT之家获悉,这份 5 月出台、目前仍在…
Anthropic指责阿里大规模蒸馏攻击,自家Claude却被曝“自称”千问和DeepSeek,双标争议再起。
IT之家 6 月 25 日消息,据 CNBC 当地时间周三报道,Anthropic 已向美国参议院银行、住房及城市事务委员会致信, 指责阿里巴巴“公然”且“非法”地试图提取其 AI 能力 。 这封信于 6 月 10 日致南卡罗来纳州共和党参议员 Tim Scott 和马萨诸塞州民主党参议员 Eliz…
将SAM 3和DINOv3蒸馏为轻量模型,实现边缘端个体级牲畜监测,兼顾精度与部署可行性
arXiv:2604.27128v2 Announce Type: replace-cross Abstract: Foundation-model pipelines for individual-level livestock monitoring -- combining open-vocab…
提出在NVFP4量化场景下通过保持内部几何结构进行LLM蒸馏,超越传统只匹配输出的方法,有望提升压缩模型效果。
arXiv:2606.05682v1 Announce Type: new Abstract: Demand for low-precision inference, including NVFP4-based approaches, has grown as large language mode…
前沿论文:反蒸馏指纹技术,用于检测LLM被无授权蒸馏,平衡鲁棒性与模型性能。
arXiv:2602.03812v2 Announce Type: replace-cross Abstract: Model distillation enables efficient emulation of frontier large language models (LLMs), cre…
OpenAI官方教你用API实现模型蒸馏,低成本微调高性能小模型,降本增效的实战指南。
Fine-tune a cost-efficient model with the outputs of a large frontier model–all on the OpenAI platform