现代汽车:2027 年车型将启用自研电芯,成本降 30%、寿命延长 20%
IT之家 8 月 27 日消息,今天(8 月 27 日)在韩国首尔举办的 CEO 投资者日上,现代汽车宣布通过开发自有电池电芯等方案, 让汽车电池成本下降 30%,寿命延长 20%。 现代汽车表示将从 2027 年开始,旗下电动汽车将采用全新中镍 NCM 电池(mid-nickel NCM cell…
IT之家 8 月 27 日消息,今天(8 月 27 日)在韩国首尔举办的 CEO 投资者日上,现代汽车宣布通过开发自有电池电芯等方案, 让汽车电池成本下降 30%,寿命延长 20%。 现代汽车表示将从 2027 年开始,旗下电动汽车将采用全新中镍 NCM 电池(mid-nickel NCM cell…
美国企业改用中国大模型降本,凸显国产AI国际竞争力
从AlphaGo称霸围棋界到ChatGPT面世,美国在算法大模型领域积累了显著的先发优势。但近年中国大模型的崛起对AI格局有所冲击。美国《华尔街日报》等多家媒体提到,中国大模型独角兽月之暗面新一代开源大模型Kimi K3撼动资本市场,并称其与DeepSeek在2025年发布时引发的市场恐慌如出一辙,…
Google Gemini 接近十亿用户里程碑,AI问答模式驱动搜索增长并降低成本,展现AI领域强劲势头。
Gemini had over 750 million monthly users in February.
Edgee推出Compressor V2,三层次压缩策略将LLM Agent成本砍半,性能与效率兼得。
Article URL: https://www.edgee.ai/blog/posts/introducing-compressor-v2-three-compression-layers-measured-end-to-end-for-a-50-cost-reduction Comments U…
探讨未来AI编程大模型:性能提升与成本下降的两难前景
Comments URL: https://news.ycombinator.com/item?id=48751300 Points: 2 # Comments: 3
英伟达Blackwell平台将DeepSeek V4推理单Token成本砍至1/5,吞吐量暴增20倍,AI推理效率再破纪录。
IT之家 7 月 1 日消息,英伟达昨日(6 月 30 日)发布博文,宣布在英伟达 Blackwell 平台上,通过优化全栈推理,相比较 DeepSeek V4 模型 1 个月前上线初期, 单 Token 成本最多降至五分之一。 IT之家注:单 Token 成本(Cost Per Token)指模型…
OpenAI 通过系统底层优化让 AI 模型推理成本骤降一半,技术突破直接利好实际应用。
IT之家 6 月 30 日消息,据 The Information 报道,OpenAI 工程师在内部透露,公司已通过一系列全新的系统底层优化,成功将 AI 模型的推理(运行)成本降低了 50% 以上。 据IT之家了解,推理成本指的是模型在实际运行并响应用户请求时所消耗的计算资源。 此次优化主要得益于…
改变AI底层数学,或成摆脱算力“军备竞赛”的关键,研究人员已证明这条路可行。
Article URL: https://www.theregister.com/ai-and-ml/2026/06/30/changing-ai-math-could-reduce-the-hardware-burden-researchers-show/5264609 Comments URL:…
别再用摘要压缩记忆了,这个项目用确定性折叠让LLM代理缓存命中率飙到92.6%,成本直降63%。
Article URL: https://github.com/dogtorjonah/context-warp-drive Comments URL: https://news.ycombinator.com/item?id=48722788 Points: 3 # Comments: 0
我国超表面电磁调控技术获突破,卫星通信终端成本降至千元级,将加速5G/6G及商用卫星发展。
IT之家 6 月 15 日消息,据中国运载火箭技术研究院官方消息,火箭院研究发展中心通信研究团队联合上海航天电子有限公司,在新型电磁调控核心技术领域取得阶段性关键突破,成功完成 超表面电磁调控核心技术功能样品研制, 实现了技术自主可控与工程化落地。 IT之家获悉,该技术应用场景覆盖面广、适配性极强,…
特斯拉折叠式超充站落地欧洲,部署效率提升33%、成本降低超两成,乘用车最高500kW输出功率,加速充电网络普及。
IT之家 6 月 11 日消息,特斯拉折叠式超级充电站已正式落地欧洲。官方透露,计划在 2026 年第三季度将其广泛部署到欧洲大陆的主要高速公路休息站,目前一处新站点已进入安装阶段。此次落地也标志着特斯拉的充电网络扩张思路出现明显转变:不再只聚焦硬件性能,而是着手优化整条物流供应链。 特斯拉并未公布…
实时压缩代码上下文,降低LLM API成本50-80%,可直接嵌入的代理工具。
Article URL: https://github.com/borhen68/TokenTamer Comments URL: https://news.ycombinator.com/item?id=48458633 Points: 1 # Comments: 1
开源项目通过独创“快照”机制,让AI编程成本直降98%,记忆力从30分钟跃升至3小时,登顶GitHub Hacker News。
文|李嘉星 编辑|周鑫雨 一句话介绍 context-mode 是一款专为 AI 编程打造的上下文优化 MCP(Anthropic 发布的模型上下文协议)插件。 它解决了开发者在长周期开发中遭遇的“模型失忆”与“Token 过多消耗”的核心痛点。 据团队表示,在编程场景下,context-mode …
AI代理读取内容前自动压缩,最高减少90% token消耗,实现成本断崖式下降。
Article URL: https://pypi.org/project/headroom-ai/ Comments URL: https://news.ycombinator.com/item?id=48349275 Points: 1 # Comments: 0
企业AI降本未达预期,贝恩报告揭示四成公司成本降幅不足10%,谨慎看待AI商业化效果。
IT之家 6 月 1 日消息,据彭博社今天报道,贝恩咨询公司最近发布全球大型企业调查报告,显示企业通过 AI 和自动化实现降低成本的效果普遍低于预期。 本次调查完成于今年 4 月, 共收集 951 家营收超过 1 亿美元(IT之家注:现汇率约合 6.77 亿元人民币)的企业反馈 ,涵盖零售、科技、先…
小米首次公开MiMo模型推理系统全链路优化细节,Hybrid SWA等工程化实践将架构优势转化为真实效率提升,最高降价99%。
IT之家 5 月 30 日消息,5 月 27 日, 小米 MiMo-V2.5 系列 API 完成永久降价 , 最高降幅达 99% ,不区分输入长度。今日,小米正式公开 MiMo-V2.5 系列模型的推理系统全链路优化方案。 据介绍,该团队围绕 Hybrid SWA + MoE + 多模态的复合架构,…
开源LLM上下文优化工具,剔除95%无关token,将百万token知识库查询成本降到极致。
Article URL: https://github.com/zzorphcreator/knowa Comments URL: https://news.ycombinator.com/item?id=48328512 Points: 1 # Comments: 0
DeepSeek V4新工具缓存命中率99.82%,长会话成本直降80%,2折玩转大模型。
原本4亿+token、61美元的账单,直降至12美元
OlmoEarth v1.1在训练和推理上分别节省1.7倍GPU时间和2.9倍MACs,效率大幅提升。
arXiv:2605.20804v1 Announce Type: cross Abstract: We present a set of improvements to the OlmoEarth family. These improvements allow us to cut compute…