AI本地部署不如官方版的元凶找到了:734个依赖包,每一个都可能坑
推理软件栈的微小差异,就能改变输出token
推理软件栈的微小差异,就能改变输出token
IT之家 8 月 27 日消息,Amazon AWS(亚马逊云科技)在与 NVIDIA 的联合新闻稿中宣布,计划在 2027~2028 年期间向其全球基础设施额外部署 200 万块 NVIDIA GPU。 AWS 此前已在今年 3 月的 GTC 2026 承诺了 100 万块的 NVIDIA GPU…
OpenAI自研Jalapeño芯片基准测试曝光,专为大规模快速推理而生,直面英伟达Blackwell。
Tested on SemiAnalysis’ InferenceX benchmark, Jalapeño registered both more tokens per user and more throughput per kilowatt than the currently availa…
用证据门控从结构上杜绝漏洞幻觉的AI渗透测试智能体,全离线运行,安全报告终于不是AI编的故事了
If you point any LLM at a target and ask it to "write a security report," it will confidently invent findings that aren't there: an imagined TLS weakn…
5分钟在任意GPU上部署Llama-70B,无需K8s,开源平台一键搞定。
Article URL: https://llmpanel.io Comments URL: https://news.ycombinator.com/item?id=49429521 Points: 1 # Comments: 0
自托管协作套件,洋葱路由加三服务隔离架构,实时协作延迟出乎意料地可用,多平台可部署。
Selfhost a full suite of collaboration tools powered by onion v3 routing and a isolated three dedicated service architecture. Surprisingly usable late…
对比三大 LLM 推理框架 Ollama、vLLM 与 SGLang,理清性能与适用场景,帮你选对部署方案。
To use open-weight models on your machine, you have three main options: Ollama, vLLM, and SGLang. But each engine handles requests differently.
本地运行隐私优先的LLM服务,敏感文本不触达外部模型,开源可自部署。
Article URL: https://github.com/ar0per0/Daimon Comments URL: https://news.ycombinator.com/item?id=49408697 Points: 1 # Comments: 0
IT之家 8 月 23 日消息,特斯拉的 Robotaxi 业务在内华达州刚刚迎来一次大规模扩张。 内华达州运输管理局(Nevada Transportation Authority)于当地时间周四批准了特斯拉的完整“自动驾驶汽车网络公司”运营许可证,为该公司未来 12 个月内在克拉克县部署最多 5…
手把手拆解Transformer注意力机制与多GPU并行,家庭AI集群实战避坑指南。
Article URL: https://jdagostino.github.io/ai-pt2-multi-gpu-drifting/index.html Comments URL: https://news.ycombinator.com/item?id=49377155 Points: 2 #…
AI 模型间互不理解的痛点,用一门全新编程语言来解:开源、本地运行,内置编译器和 50+ 张量操作。
🟢 I Built the World's First AI-to-AI Communication Language TL;DR: Создал Vireo — язык программирования для ИИ-моделей. Компилятор, интерпретатор, API…
开源AI编程工作台,本地跑模型,AI代理写代码、管看板,一站式交付
ChatOSS is built on Ollama. If you use Ollama, ChatOSS local works out of the box. ChatOSS is a GUI desktop app that has multiple agentic coding apps …
无需自建环境,Cloudways托管运行OpenClaw与Hermes,快速启用AI代理,适合想省时省力的开发团队。
Skip the setup and run OpenClaw & Hermes, fully managed Discussion | Link
大模型2-3比特量化精度崩坏?这项研究用分组离散优化突破极限,无需反向传播即可部署。
arXiv:2608.15567v1 Announce Type: new Abstract: Weight-only post-training quantization (PTQ) enables the deployment of large language models under tig…
黄仁勋官宣OpenAI 2030年前锁定12GW英伟达算力,揭示AI基建万亿级商机,行业风向标必读。
IT之家 8 月 17 日消息,英伟达 CEO 黄仁勋今天(17 日)晚间通过官方博客撰文称,OpenAI 已承诺在 2030 年前 大规模部署英伟达 AI 基础设施 。 OpenAI 现有和计划中的部署承诺合计 约为 12GW(吉瓦)英伟达算力 ;如果英伟达将 PORTS-Pike 合作扩大到首期…
用AI定制从入门到进阶的课程,再通过提问检测你的理解,开源可自部署。
I used to learn from books and courses. But I kept realising I hadn't built a real mental model. I always needed an LLM on the side to fill in what th…
一款美观开源的在线EPUB阅读器,还附带txt转EPUB的自动工具,阅读制作两不误。
Flow 是一款美观、开源的在线开源 EPUB 电子书阅读器。可以在线使用,也可以自部署。@Appinn 来自 VIctoryRoad 同学推荐的在线 ePub 阅读器:https://meta.appinn.net/t/topic/89550 Flow 可以离线运行(在安装后),而非离线时,Flo
AI代理落地如何规避风险?这篇论文提出系统化部署框架,直击安全与可靠性痛点。
arXiv:2608.16411v1 Announce Type: cross Abstract: LLM-based agents are rapidly moving from research prototypes into the core business processes of org…
国家超算互联网上线DeepSeek V4 Pro正式版,原生支持OpenAI API并适配Codex,一站式部署开发更省心。
IT之家 8 月 15 日消息,8 月 14 日,国家超算互联网宣布上线 DeepSeek V4 Pro 正式版(DeepSeek-V4-Pro-0813),以及智能体框架 DeepSeek Harness。 官方介绍称,作为 全国首个十万卡级 超智融合算力资源池,国家超算互联网可为广大科研院所、科…