微信鸿蒙版 App 获 8.0.21.16 版本邀测升级
微信鸿蒙版邀测升级,新增星标收藏、缓存清理和最近转发,体验更顺手。
IT之家 8 月 24 日消息,微信鸿蒙版 App 今日在华为应用市场(App Gallery)开启了 8.0.21.16 (8394000) 版本邀测升级(需收到短信通知后点击链接跳转安装,未收到短信需继续等待),测试时间为 2026/8/24-2026/9/24。 和往常一样,本次更新的说明依旧…
Stop chasing fads. Operate Claude like a startup founder.
用创业者的成本思维使用Claude:缓存不变的系统提示词与工具定义,输入成本能降到约十分之一。
I am running an AI-native startup. Early on though, I would spend so much time staying ahead of every new AI hot take that I lost focus on what I need…
HLD: URL Shortener (like bit.ly)
像bit.ly一样的高性能短链接服务,MD5+Base62生成短码,读多写少场景下响应极快
Design a system that takes a long URL and returns a short URL, and redirects short URLs to their originals. 1️⃣ Clarify Requirements Functional Requir…
AMD 确认 Radeon RX 9050 (4GB) 显卡技术细节:无限缓存同样砍半
IT之家 8 月 20 日消息,AMD 今日发布了最新的 AMD Software: Adrenalin Edition 26.8.1 显卡驱动程序,新增产品支持、多款新游戏优化,同时修复了多个已知问题。 随着新版本驱动的推出,Radeon RX 9050 (4GB) 显卡也正式上线 AMD 官网。…
GitHub API Rate Limits: an Unauthenticated 304 Still Costs You a Request
GitHub API未认证请求即使返回304也照样消耗速率限制配额,开发中必须留意这个易踩的坑。
No token. One IP. July 29, 2026: GET /repos/python/cpython 200 5996 B remaining 32 -> 31 + If-None-Match (no Authorization header) 304 0 B remainin…
Pallas: A Proactive KV Cache Migration Framework for LLM Inference in AI-RAN
首个面向AI-RAN的主动式KV缓存迁移框架,直击LLM推理中长序列与多边缘节点的时延痛点,架构设计值得关注。
arXiv:2608.16477v1 Announce Type: new Abstract: AI-RAN brings large language model (LLM) serving close to mobile users, but cellular handover can sepa…
英特尔被曝在 "Razor Lake" 世代推出 bLLC 大缓存移动端处理器
IT之家 8 月 18 日消息,消息人士 @jaykihn0 今日爆料称, Intel(英特尔)将在 "Razor Lake" 世代推出配备 bLLC 大型末级缓存的移动端处理器 。 结合此前其昨日的发言来看,这里指的应该是面向游戏本等终端的 "Razor Lake HX" 高性能变体,因为 "Ra…
科技爱好者周刊(第 408 期):你需要知道的 AI 缓存知识
AI缓存让重复对话成本骤降,命中价仅为未命中的五十分之一,十分钟内免重算,省钱关键必看。
这里记录每周值得分享的科技内容,周五发布。...
Mac 磁盘爆满不用慌,Mole 帮你一键深度释放空间!
Mac磁盘爆满?Mole一键深度清理缓存,整合磁盘分析、应用管理等实用功能,实测可释放8-11GB空间。
今年一款 Mac 工具在开发者圈子里悄然走红,目前在 GitHub 上已收获 6 万多星标收藏,连 Paul Graham (保罗·格雷厄姆,世界知名程序员、投资人) 都曾专门发文讨论它。 它就是 Mole! 一款 Swift 原生开发的 App,整合了缓存清理、应用管理、磁盘分析、硬件监控、系统优
英特尔 Nova Lake 缓存策略调整:部分型号削减 E 核但仍保留完整 L3 缓存
IT之家 8 月 12 日消息,爆料者 Jaykihn 修正了此前关于“Nova Lake 在禁用一个 E 核集群后 L3 缓存也会减少”的说法。 最新消息显示,部分 CPU 型号在缩减 E 核数量的同时仍可能保留完整的 L3 缓存。不过,6P+12E+4LP E 的 sku 配置确认会受影响,其 …
The case for disaggregated LLM serving
把大模型推理拆成预填充和解码两段,用网络传KV缓存,破解长上下文延迟痛点,值得一读。
Article URL: https://blog.doubleword.ai/when-to-disaggregate Comments URL: https://news.ycombinator.com/item?id=49269470 Points: 4 # Comments: 0
Stateful CARS: Exact Cross-History Reuse for Policy-Constrained LLM Agents
LLM代理的跨历史缓存复用新方案,精确匹配策略约束,大幅提升推理效率。
arXiv:2608.08282v1 Announce Type: new Abstract: Tool-using language-model agents face constraints whose meaning changes with observations and prior ac…
RoRA: Role-Oriented Regional Allocation for Visual Token Pruning in MLLMs
多模态大模型提速新思路:按角色分区裁剪视觉token,兼顾效率与精度
arXiv:2608.07088v1 Announce Type: cross Abstract: Multimodal large language models (MLLMs) encode images as long visual token sequences, making prefil…
英特尔 Diamond Rapids 至强 7 ES 处理器首次现身 SiSoftware:32 核 +240MB 缓存,18A-P 工艺已跑通
英特尔下一代至强Diamond Rapids工程样品首现身,18A-P工艺跑通,32核+240MB缓存,提前窥见2027年服务器CPU布局。
IT之家 8 月 6 日消息,爆料者 @momomo_us 发现,英特尔下一代至强(Xeon)7 系列处理器“Diamond Rapids”的首款工程样品已经出现在了 SiSoftware 数据库中,确认其基于增强版 18A-P 工艺打造。 曝光的这颗工程样品配备了 32 个核心、64MB 二级缓存…
Ask HN: DeepSeek Alternatives
DeepSeek涨价在即,开发者正寻找同价位且支持缓存的高性价比替代模型。
As DeepSeek is planning on raising their prices, I'm looking to explore alternatives. Are there any comparable providers with similar model size that …
AnchorKV: Anchor-Residual KV Cache Compression
锚点加残差,KV缓存压缩新思路,兼顾低内存与高保真,值得一看。
arXiv:2608.02901v1 Announce Type: new Abstract: The key-value (KV) cache is the primary memory bottleneck in long-context LLM inference. Existing appr…
Neo Semiconductor 公布 2T SRAM,宣称可实现 5 倍片上缓存容量
IT之家 8 月 5 日消息,3D 存储半导体 IP 企业 Neo Semiconductor 在 FMS 2026 上公布了其双晶体管 (2T) SRAM 设计 X-SRAM, 宣称可实现现有方案 5 倍的片上缓存容量 。 IT之家了解到,目前的商业化主流 SRAM 由 6 个晶体管构成,这限制了…
RAP: KV-Cache Compression via RoPE-Aligned Pruning
直击长上下文推理痛点,用RoPE对齐剪枝实现KV-Cache压缩,兼顾效率与精度。
arXiv:2602.02599v4 Announce Type: replace-cross Abstract: Long-context inference in large language models (LLMs) is bottlenecked by the memory and com…
How to put a hard daily cap on your LangChain.js API costs
LangChain.js API 费用失控?一个硬性每日上限方案帮你止住账单爆炸,还拆解了令牌计费的四种坑。
If an agent decides how many API calls to make, your cost ceiling is whatever the agent feels like today. Most days that's fine. The day a tool errors…