视频
-
LobsterAI接入四大图像视频模型:一个平台搞定Seedream、Seedance、HappyHorse、MiniMax-Hailuo
核心看点: 一次性接入Seedream、Seedance、HappyHorse、MiniMax-Hailuo四大主流模型 多模型矩阵联动,降低开发者和创作者调用多模态AI的门槛 覆盖图片生成和视频生成两大领域 做内容创作的人有个痛点:不同AI画图和视频工具各有优劣,换来换去很麻烦。LobsterAI的新动作就是解决这个问题——把四大主流图像视频生成模型整合到一个平台里。 四大模…
-
Google Gemini Omni登场:首个”万物生万物”模型,视频创作进入新纪元
Google Gemini Omni登场:首个”万物生万物”模型,视频创作进入新纪元 核心看点:Google DeepMind正式发布Gemini Omni——一个能”从任意内容生成任意内容”的生成式模型,首发支持视频生成。这标志着生成式AI从”文本生图片/视频”的单向模式,正式迈入”任意模态互…
-
谷歌Gemini Omni发布:一句话让AI改视频,全模态转换成现实
核心看点 谷歌在2026 I/O大会发布Gemini Omni,宣称能”从任何输入生成任何输出” 首款模型Gemini Omni Flash聚焦视频领域,支持对话式编辑 用户可通过自然语言指令实时修改视频中的角色、场景、背景 物理一致性引擎确保生成内容符合真实物理规律 详细解析 在2026年Google I/O开发者大会上,谷歌正式推出Gemini Om…
-
美团开源LongCat数字人视频模型:10秒视频1分钟生成,击败主流闭源
美团龙猫团队开源了商用级数字人视频生成模型LongCat-Video-Avatar1.5,生成10秒视频只要约1分钟,而且效果全面超过主流闭源模型。 三大升级: 嘴型更准:音频编码器从Wav2Vec2换成Whisper-large,发音节奏和音素变化捕捉更细腻 手不崩了:引入GRPO技术,解决数字人视频里常见的手部畸形和动作不连贯问题 速度快15倍:采用DMD技术,推理效率大幅…
-
谷歌Gemini Omni登场:动动嘴就能改视频,AI创作进入对话时代
核心看点 Google I/O 2026 重磅发布 Gemini Omni,支持文本/图像/音频/视频多模态输入 用户通过自然语言指令即可编辑视频内容,添加/删除对象、切换镜头角度、修改风格 首款模型 Gemini Omni Flash 已上线 Gemini 应用,面向全球 AI 订阅用户开放 详细解析 在 2026 年 Google I/O 开发者大会上,谷歌正式推出了 Ge…
-
Google重磅发布Gemini Omni:一个模型生成万物,视频创作进入新纪元
核心看点:Google DeepMind刚刚发布了Gemini Omni,这是他们首款”万物生成”模型——能从任何内容生成任何内容,首发支持视频创作。这标志着AI多模态能力的一次质的飞跃。 什么是Gemini Omni? Gemini Omni不是简单的视频生成工具。它结合了Gemini的智能理解能力与Google的生成式媒体系统,实现了对世界理解、多模…
-
拿2500万用户的团队不卷AI视频生成了,改做”视频PS”Buzzy,融了2000万美元
【核心看点】• AI视频公司Creati(2500万用户、1500万美元ARR)推出新产品Buzzy,不做视频”生成”,专做视频”修改”• 定位”视频版Photoshop”,用户上传已有视频,用自然语言描述修改需求即可完成换人、调光、去路人等操作• 已获红点2000万美元融资,不绑定单一基模,同时使用Sor…
-
阿里 HappyHorse 1.0 视频生成模型开启灰测:15 秒多镜头叙事,千问 App 免费体验
4月27日,阿里巴巴正式宣布视频生成模型 HappyHorse 1.0(欢乐马)开启灰度测试。这款此前神秘登顶 Artificial Analysis AI Video Arena 排行榜的模型,终于向大众揭开了面纱。全球创作者和企业用户可通过官网和阿里云百炼平台注册体验,普通用户则可在千问 App 中直接尝鲜。 核心看点 支持 15 秒多镜头叙事,可生成连贯剧情短片,支持多画…
-
腾讯视频宣布全AI制作长剧和电影,第三季度正式上线
在第十三届中国网络视听大会上,腾讯公司副总裁、腾讯在线视频董事长孙忠怀透露,腾讯视频正在用AI全流程制作十几集的剧集和90分钟的电影,预计第三季度对外发布。这标志着AI正式从短创意视频杀入长内容领域。 核心看点 全AI长内容:AI全流程制作十几集连续剧和90分钟电影,第三季度上线 行业首创:目前业界AI视频多为两三分钟的”玩梗”短视频,30分钟以上长内容…
-
火山引擎Seedance 2.0全面开放API:文图音视频四模态输入,视频生成进入SOTA时代
火山引擎今日正式上线 Seedance 2.0 系列 API 服务,面向企业和个人开发者全面开放其视频生成能力。作为当前视频生成领域的全球 SOTA 模型,Seedance 2.0 的推出标志着 AI 视频创作正式进入多模态工业化应用阶段。 核心看点 四模态融合输入:支持文字、图片、音频、视频四种模态输入,集成业界最全面的多模态内容参考和编辑能力 物理准确度大幅提升:在复杂交互…
