Mistral 开源 30 亿参数内容审核模型 Shieldstral
法国 AI 公司 Mistral 发布开源多模态安全分类器 Shieldstral。该模型采用 Apache 2.0 许可,参数规模为 30 亿,可在一张 16GB 的 NVIDIA 显卡上运行。Mistral 表示,它将内容审核转为基于自然语言政策的“是/否”判断,无需为修改规则重新训练模型,并称其在多项安全与多模态基准上可匹敌甚至超过体积大 7 倍的同类开源模型。

法国 AI 公司 Mistral 发布开源多模态安全分类器 Shieldstral。该模型采用 Apache 2.0 许可,参数规模为 30 亿,可在一张 16GB 的 NVIDIA 显卡上运行。Mistral 表示,它将内容审核转为基于自然语言政策的“是/否”判断,无需为修改规则重新训练模型,并称其在多项安全与多模态基准上可匹敌甚至超过体积大 7 倍的同类开源模型。

MiniMax 于 7 月 31 日发布新一代全模态生成模型 H3,并表示将于近日开源模型权重。该模型支持文字、图片、音频、视频混合输入,可一次生成音画同步的 2K 视频。官方称其 2K 视频生成价格为每秒 0.8 元人民币,15 秒内容约 12 元,并主打 Omni-Reference 多模态参考、视频编辑、多镜头叙事与动作迁移等能力。

德国 AI 实验室 Black Forest Labs 于周四发布 FLUX 3,这是其旗舰模型首次从静态图像生成扩展到视频生成。该模型在同一套系统中同时学习图像、视频和音频,可生成最长 20 秒、音画同步的视频片段。Black Forest Labs 还公布了机器人系统 FLUX-mimic,并称奥迪已在柔性车门密封条装配等任务中测试该方案。



MiniMax在WAIC2026期间集中展示旗舰模型MiniMax M3、多模态模型及AI原生产品,并对新一代多模态生成模型H3进行预热。现场案例覆盖机器狗、AI眼镜、智能耳机、NAS、金融服务和影视内容等方向,展示其从底层模型、智能体产品到具体应用的落地进展。

开发者 Eric Lu 发布的 Ghost Font 以动态噪点视频隐藏文字,视频一夜播放超过 1700 万次。该实验最初让 Claude Fable、GPT-5.6 Sol Ultra 等模型误读作者埋设的诱饵信息,但 Riley Goodside 仅用一句方向提示,就让 GPT-5.6 Sol 在 1 分 56 秒内读出真实内容。这场测试把焦点拉回一个问题:现有多模态模型与人类在运动感知上的差距,到底还有多大。
