苹果 M5 Max MacBook Pro 供电边界:极限负载下每小时掉电 12%
IT之家 8 月 30 日消息,科技媒体 NotebookCheck 昨日(8 月 29 日)发布博文,测试苹果 2026 款 M5 Max 芯片 16 英寸 MacBook Pro, 发现随附的 140W 电源适配器可能无法覆盖整机峰值需求。 该媒体在测试中指出,在 Cinebench R23 多…
IT之家 8 月 30 日消息,科技媒体 NotebookCheck 昨日(8 月 29 日)发布博文,测试苹果 2026 款 M5 Max 芯片 16 英寸 MacBook Pro, 发现随附的 140W 电源适配器可能无法覆盖整机峰值需求。 该媒体在测试中指出,在 Cinebench R23 多…
用最优传输理论动态放置专家副本,从拓扑感知角度根治MoE训练负载失衡,值得算法工程师细读。
Article URL: https://arxiv.org/abs/2608.03676 Comments URL: https://news.ycombinator.com/item?id=49330030 Points: 1 # Comments: 0
应对突发推理负载,改进WAIT调度算法,提升LLM服务稳定性与吞吐量。
arXiv:2608.06135v1 Announce Type: new Abstract: Large Language Models (LLMs) such as ChatGPT and Claude are widely used for information retrieval and …
IT之家 8 月 3 日消息,红魔游戏手机官方今日宣布,红魔磁吸散热器 6 Pro+ 全平台现已开售。新品主打 33W 峰值功率、至高负载降温 77℃、至低制冷-21℃、重量仅 102g, 首销价 189 元 。 京东 努比亚红魔 6 Pro+ 首发 189 元 直达链接 据介绍,红魔磁吸散热器 6…
IT之家 8 月 3 日消息,据外媒 wccftech,自苹果 MacBook Pro M5 Max 版本上市以来,有不少用户抱怨相应产品在高负载环境下出现散热压力。 例如,近期有用户“rinsewin”在 Reddit 平台发文,称自己的 MacBook Pro M5 Max 版本因发…
新论文提出WISERouter,在预算约束下智能路由LLM请求,兼顾成本与性能。
arXiv:2607.23765v1 Announce Type: new Abstract: Large language models (LLMs) achieve impressive performance across multiple domains, but using the mos…
Geekbench 7 CPU跑分工具首次亮相,新工作负载全面升级,首批成绩揭示性能变化
IT之家 7 月 23 日消息,据IT之家小伙伴反馈, Geekbench 7 CPU 跑分工具已悄悄现身 ,目前已有多个 Geekbench 7 跑分信息上传到平台,最早上传时间为 7 月 21 日。 不过,目前 Geekbench 官网提供的各平台软件依然是 Geekbench 6。 有博主表示…
全球首款半人马机器人亮相上海,负载能力超200kg,专为特种场景打造,硬核机械与AI融合新突破。
IT之家 7 月 20 日消息,在上周末的 2026 世界人工智能大会(WAIC)现场,润科具能发布了 全球首款半人马机器人 。 姓名: “半人马”轮足复合机器人 定位: 自主巡检、消防应急抢险, 针对特定场景深度定制 的特种“选手” 核心技能: 轮式速度 + 足式高通过性,具备全地形高效移动能力 …
9秒变388秒!AMDGPU驱动性能暴跌42倍,Ubuntu与多发行版用户遭殃。
IT之家 7 月 17 日消息,Ubuntu 内核团队昨日(7 月 16 日)在社区发帖,指出 Linux 7.0.0-28.28 内核版本由于 AMDGPU 驱动问题, 会导致 ROCm 计算负载吞吐性能降至 42 分之一。 IT之家注:AMDGPU 是 AMD 在 Linux 平台上的官方开源图…
GPT-5.6 Terra tier仅$2.50/百万输入token,1M上下文窗口直击生产负载痛点,性价比碾压Sol。
GPT-5.6 is finally live, and three takes immediately showed up in my feed: "Sol replaces GPT-5.5 everywhere." "The API still isn't broadly available."…
IT之家 6 月 29 日消息,英伟达昨日(7 月 7 日)发布博文,指出在智能体 AI 时代,NVIDIA Vera CPU 成为“可规模化单线程最强 CPU”, 持续单核性能是 x86 的 1.8 倍。 在博文中,英伟达提出“可规模化单线程最强 CPU”(Max single-threaded …
用在线线性规划算法优化LLM服务的多目标路由,兼顾效率与资源均衡
arXiv:2607.03948v1 Announce Type: new Abstract: We study the online routing problem in large language model serving, where requests arrive sequentiall…
突破传统调度局限,让文本特征成为预测算力负载的关键信号。
arXiv:2607.04951v1 Announce Type: cross Abstract: Standard distributed \ac{llm} schedulers rely on static token counts or rolling latency averages, ma…
命令行下的 API 压测利器,轻松模拟高并发请求,秒级掌握服务性能极限
لقد نشرت نقطة نهاية API، وهي تعمل في المتصفح. لكن السؤال العملي هو: ماذا يحدث عندما يطلبها 400 مستخدم في الوقت نفسه؟ هل يبقى زمن الاستجابة مستقرًا؟ هل…
负载感知的预填偏转设计,破解分离式LLM服务的时延难题
arXiv:2607.02043v1 Announce Type: cross Abstract: Disaggregated LLM serving runs prefill and decode on separate GPU pools to keep the two phases from …
首个编码智能体负载画像公开数据集,揭示LLM服务系统的长上下文与爆发性流量特征,优化推理部署必读。
arXiv:2606.30560v1 Announce Type: new Abstract: Coding agents are rapidly becoming a major application of agentic LLMs, but serving them efficiently r…
开箱即用的LLM API模拟器,支持GPT-5/4/Claude等延迟配置,轻松压测你的AI应用。
Testing LLM apps and agent frameworks against real APIs is expensive, rate-limited, slow, and non-reproducible. LLMSim is a Rust simulator for the Ope…
IT之家 6 月 25 日消息,据新华社消息,今日在厦金大桥(厦门段)环岛路隧道“厦金号”盾构机掘进现场,国产智能盾构换刀机器人正式投用。 据介绍,机器人拥有 11 个独立可控活动关节 ,具备高避障能力与精细操作能力,凭借 500 公斤的负载能力 和灵活伸缩的结构,可覆盖 10 米至 18 米级超大…
IT之家 6 月 16 日消息,AMD 公司昨日(6 月 15 日)发布公告, 宣布收购内存优化技术公司 MEXT,目标是缓解数据中心日益突出的内存瓶颈。 IT之家援引博文介绍,在 AI、数据分析、虚拟化和高性能计算负载持续膨胀后,现代数据中心普遍面临内存资源紧张的问题。对云服务商和企业客户来说,内…
为Claude账户打造智能负载均衡,预测性调度提升API调用效率,开源方案值得尝试。
Article URL: https://github.com/yasyf/cc-pool Comments URL: https://news.ycombinator.com/item?id=48515767 Points: 1 # Comments: 0