SGLang 把 MiniMax-H3 无损提速 1.95 倍
编辑精选 同样的去噪步数、同样的 8 卡 H200,换个推理运行时就快近一倍,这部分提速一分画质都没掉。再往上的 6.24 倍要拿 SSIM 换,0.76 已经是肉眼能看出差别的区间,那一档更适合筛构图而非出成片。 LMSYS 团队 8 月
收录 视频生成 相关 AI 新闻、产品动态和产业观察。 本页收录 14 篇已发布文章。
编辑精选 同样的去噪步数、同样的 8 卡 H200,换个推理运行时就快近一倍,这部分提速一分画质都没掉。再往上的 6.24 倍要拿 SSIM 换,0.76 已经是肉眼能看出差别的区间,那一档更适合筛构图而非出成片。 LMSYS 团队 8 月
编辑精选 老版本续接只看最后一秒,接出来常像换了片场;1.1 让模型回读前十秒再往下写,四十秒的连贯片段第一次落在 Flash 这一档的价位上。谷歌押的仍是拆段拼接,靠上下文窗口补接缝。 8 月 27 日,谷歌把视频模型 Gemini Om
编辑精选 免费档给到720p、单段4到12秒、每分钟3次请求,够试手不够量产;正式版每天送200积分,按每秒2积分算能出100秒。这套额度把漏斗画得很直白:先让人跑通全流程,再在时长和分辨率上收钱。 8月26日,Agnes Video 2.
编辑精选 30 秒时长加上文档直接转视频,Wan3.0 瞄准的是短剧和广告这类批量生产场景。1080P 一条 30 秒按促销价 25.2 元,这个数字比参数表更能决定它进不进生产流程。 阿里视频生成模型 Wan3.0 在 8 月 24 日全
编辑精选 4K 商品视频的行业惯例是生成一遍、放大一遍,卖家要跑两次流程、算两笔账。PixPix 把 Black Forest Labs 的 FLUX Upscale 接进了自己的流水线,两段变一段,省掉的是卖家最不该花在工具上的那几个小时
编辑精选 每百万像素每秒 0.07 美元的定价,把一段十秒 4K 片子的清晰化成本推到六美元以上。后期放大站到了比生成本身更贵的一侧,这是视频模型商业化里少有人摊开算的一笔账。 Black Forest Labs 放出了一个叫 FLUX U
编辑精选 H3 单次生成上限还是 15 秒,Design 却拿它做出了 3 分钟的片子。补上去的不是生成能力,是镜头之间的连贯性和一条能反复改的时间线——这块恰好是剪辑软件几十年攒下的家底。 MiniMax 在 8 月 20 日推出 Min
编辑精选 Seedance 2.5 的新意不限于 30 秒长度,字节把参考素材、按秒点位编辑和上线入口同时摆出来,视频模型开始更像制作工具。 视频模型的竞争,过去常被压缩成一个问题:谁的画面更像电影。字节跳动 7 月 31 日正式发布 Se
编辑精选 MiniMax H3 把 2K、15 秒、原生立体声和开源权重放在同一张发布牌上;0.8 元/秒的价格很醒目,但开放权重仍要等后续文件落地。 7 月 31 日,MiniMax 发布 H3,多模态视频模型赛道多了一个很少见的组合:官
Google DeepMind 这次没有再展示一个更会“造视频”的模型。 它把视频生成模型拆开,改成了一个会做视觉感知的模型:看一段视频,按文字指令输出深度、法线、相机位姿、分割结果和 3D 关键点。论文给这个系统起名 GenCeption
6 月 30 日,谷歌向开发者放出两个新模型:图像模型 Nano Banana 2 Lite,和还在公测阶段的视频模型 Gemini Omni Flash。两者都归在 Gemini 3.1 这一代下面,方向也是同一个:把生成媒体的单位成本压
时机选得很妙。 就在OpenAI宣布关停Sora不久之后,Google在3月31日上线了Veo 3.1 Lite,直接定位成最低成本视频生成模型,开放给开发者通过Gemini API接入。 这不是巧合,这是Google很清楚Sora退场留下
MiniMax这家公司在国内AI圈一直比较低调,但 海螺AI 的视频生成能力在圈内已经有了不小的口碑。 产品形态 海螺AI是MiniMax面向C端的产品,涵盖文本对话、语音合成和视频生成。其中视频生成是最拿得出手的。 用户可以通过文字描述生
OpenAI宣布关停Sora视频生成服务的消息在圈内引发了不小的震动——毕竟这是当初发布时最轰动的产品之一。 为什么关了 核心原因很现实: 每天亏损约100万美元 。 视频生成的计算成本远高于文本生成。每次生成一段视频需要的GPU算力是文本