今天我们正式开源了新一代通用视频模型 MiniMax H3。 本文篇幅较长,以下为全文目录,供大家按需阅读。 模型概览 模型架构 H3-Context-IR H3-Base · H3-Encoder · H3-VAE · H3-Omni-Transformer H3-Regene...
开放通用智能,MiniMax H3 正式开源
浏览 26 评论 0 收藏 0 点赞 0
华为开放openPangu-2.0-Pro:5050亿参数、512K上下文,权重与昇腾推理代码同步上线
2026年7月31日,华为正式开放 openPangu-2.0-Pro 模型权重、技术报告及基础推理代码。 openPangu-2.0-Pro是一款基于昇腾NPU完成训练的大规模混合专家语言模型,总参数约505B,即5050亿参数,每个Token实际激活约18B参数,并支持512K上下文。模型预训练数据规模约为34T Tokens。 模型目前已经上线GitC
浏览 45 评论 0 收藏 0 点赞 0
DeepSeek-V4-Flash正式版上线:130亿激活参数,多项Agent测试远超V4-Pro预览版
2026年7月31日,DeepSeek正式上线 DeepSeek-V4-Flash-0731 ,并开启正式版API公测。 开发者无需更换接口地址,只需将模型名称设置为: deepseek-v4-flash 即可调用最新正式版本。 DeepSeek表示,此次更新重点提升Agent能力。在Terminal Bench 2.1、NL2Repo、CyberGym、D
浏览 60 评论 0 收藏 0 点赞 0
字节跳动Seedance 2.5正式发布:单次生成30秒,支持一镜到底与多镜头长叙事
2026年7月31日,字节跳动Seed团队正式发布新一代视频创作模型 Seedance 2.5 。 新模型将单次音视频生成时长从15秒提升至30秒,并重点升级长叙事、多模态参考和视频编辑能力。它既可以根据提示词生成连续的一镜到底镜头,也能在30秒内自动组织多个具有逻辑关联的镜头,让故事经历铺垫、推进、转折和收尾,而不是把一个简单动作机械延长。 Seedanc
浏览 34 评论 0 收藏 0 点赞 0
MiniMax发布全模态视频模型H3:15秒2K原生音视频生成,API价格每秒0.13美元
2026年7月31日,MiniMax正式发布新一代通用全模态视频生成模型 MiniMax H3 。 H3可以在同一个上下文中理解文本、图片、视频和音频,并输出最长15秒、2K分辨率、带原生双声道声音的视频。模型还支持已有视频编辑、首尾帧控制、多参考素材生成,以及将参考视频中的动作、镜头和节奏迁移到新角色或场景中。 MiniMax表示,H3面向广告、品牌、电商
浏览 54 评论 0 收藏 0 点赞 0

