通用视频模型 MiniMax H3 正式开源,支持多模态上下文、2K 分辨率
IT之家 8 月 3 日消息,今日 MiniMax 正式开源新一代通用视频模型 MiniMax H3。 据介绍,MiniMax H3 是一个通用型全模态生成系统。它能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高 2K 分辨率、最长 15 秒、带有原生立体声音频的视频。得益于以任…
IT之家 8 月 3 日消息,今日 MiniMax 正式开源新一代通用视频模型 MiniMax H3。 据介绍,MiniMax H3 是一个通用型全模态生成系统。它能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高 2K 分辨率、最长 15 秒、带有原生立体声音频的视频。得益于以任…
银河证券研报指出,Kimi K3上线后仅48小时,请求量便把现有集群打满,随后Kimi宣布暂停C端新用户会员订阅,验证Kimi K3模型能力突出与算力紧缺。银河证券认为,Kimi K3并非抑制算力需求,一方面国产开源模型的能力逼近全球顶级闭源模型,倒逼顶级大模型厂商通过更大规模的训练以及更快的迭代来…
美团 LongCat-2.0 总参数 1.6T,平均激活约 48B,为真实的 Agentic Coding 任务而生,架构上创新性引入 LongCat 稀疏注意力和 N-gram Embedding,提升长上下文处理效率与 Token 级表示能力的同时,结合动态激活进一步强化了代码理解、生成以及执行…
蚂蚁灵波LingBot-VLA 2.0开源,支持20多种机器人构型,6万小时真实数据预训练,机器人通用能力再升级。
华为开源盘古2.0-Flash模型,920亿参数,支持推理与训推算子,赋能鸿蒙系统级任务执行。
IT之家 6 月 30 日消息,华为官方宣布,华为开源盘古 920 亿参数的 openPangu-2.0-Flash 模型 今天(30 日)正式开源上线。 根据介绍,开源盘古 openPangu 是华为开源 AI 模型品牌,致力于通过昇腾原生训练与推理技术,为业界用好昇腾提供最佳实践参考,助力打造 …
MiniMax发布原生多模态旗舰模型M3,百万上下文+428B参数,现已开源并提供稀疏注意力技术。
IT之家 6 月 15 日消息,稀宇科技 MiniMax 在上周五(6 月 12 日)开源了 MiniMax M3 模型权重,并同步发布了 MSA(MiniMax Sparse Attention) 技术论文 , 今日官方正式开源 MiniMax M3 模型 。 据介绍,M3 是 MiniMax 的…
LongCat-Video-Avatar 1.5是一款从开源 SOTA 迈向商业级应用的数字人视频模型。在唇形同步、物理合理性、长视频稳定性、多人互动和高效推理上实现了全面跃升。LongCat-Video-Avatar 1.5 即便在复杂商业场景里,也能稳定、自然地输出高质量内容,让数字人视频生成从…
美团开源LongCat-Video-Avatar 1.5,从高拟真迈向真可用,视频生成技术新突破。
LongCat-Video-Avatar 1.5是一款从开源 SOTA 迈向商业级应用的数字人视频模型。在唇形同步、物理合理性、长视频稳定性、多人互动和高效推理上实现了全面跃升。LongCat-Video-Avatar 1.5 即便在复杂商业场景里,也能稳定、自然地输出高质量内容,让数字人视频生成从…