1
Meta 开源 30B AI 模型 Muse Glimmer,4bit 量化可在单卡 24GB 显存 GPU 运行
IT之家 8 月 10 日消息,Meta 今日发布 AI 模型 Muse Glimmer,并在 Apache 2.0 许可协议下开源该模型权重。Muse Glimmer 是一款拥有 300 亿参数(30B) 的模型,专为全天候常驻运行的本地智能体(Agent)工作流深度优化。 官方表示,Muse G…
IT之家 8 月 10 日消息,Meta 今日发布 AI 模型 Muse Glimmer,并在 Apache 2.0 许可协议下开源该模型权重。Muse Glimmer 是一款拥有 300 亿参数(30B) 的模型,专为全天候常驻运行的本地智能体(Agent)工作流深度优化。 官方表示,Muse G…
单卡AMD MI300X跑起DeepSeek V4 Flash,低成本部署大模型的最新实践。
Article URL: https://github.com/ryanzhou/deepseek-v4-flash-mi300x Comments URL: https://news.ycombinator.com/item?id=49166386 Points: 272 # Comments: …
高德最新世界模型工坊可单卡生成小时级实时交互视频与3D场景,首创“时空任意门”实现全尺度空间无缝穿梭。
IT之家 7 月 14 日消息,今日腾讯混元发文表示,Hy3 上线并开源后,社区一直在呼吁量化版本,希望单卡跑参数量达 295B 的 Hy3。团队针对开源社区需求,把 Hy3 的权重量化到 1bit 与 4bit 并打包成 GGUF,配合 llama.cpp 生态,让原本只能跑在多卡集群上的模型,最…