AI 日报

  • AI日报:京东开源实时视频编辑模型,Qwen-Image-3.0正式上线

    欢迎来到今天的AI日报!今天AI圈又发生了不少大事,从视频编辑到图像生成,从语音识别到多模态交互,各家都在秀肌肉。来,一起看看。 京东开源JoyAI-Video-Edit:边看边改,30帧秒级推理 京东今天开源了自家研发的实时流式视频编辑模型 JoyAI-Video-Edit。这玩意儿最牛的地方在于——它能边播放边修改,720P分辨率下能做到每秒30帧的推理速度。 以前改视频得…

    2026年8月6日
  • AI日报:京东开源实时视频编辑模型,Qwen-Image-3.0正式上线,腾讯混元语音识别再升级

    欢迎来到今天的AI日报。今天有多条重磅消息:京东开源了能边播边改的视频编辑模型,阿里Qwen-Image-3.0正式上线,腾讯混元语音识别迎来3.0版本,还有字节、马斯克、影石、Mistral和宇树科技的新动态。一文带你快速过一遍。 京东开源JoyAI-Video-Edit:视频边播边改成为现实 京东今天开源了自研的实时流式视频编辑模型 JoyAI-Video-Edit。这个模…

    2026年8月6日
  • AI日报:商汤8B小钢炮U1.5-Lite-Preview发布;MiniMax H3开源排除美国;微软自研全双工AI语音模型曝光

    AI日报:商汤8B小钢炮U1.5-Lite-Preview发布;MiniMax H3开源排除美国;微软自研全双工AI语音模型曝光AI日报:商汤8B小钢炮U1.5-Lite-Preview发布;MiniMax H3开源排除美国;微软自研全双工AI语音模型曝光AI日报:商汤8B小钢炮U1.5-Lite-Preview发布;MiniMax H3开源排除美国;微软自研全双工AI语音模型曝光AI日报:商汤8B小钢炮U1.5-Lite-Preview发布;MiniMax H3开源排除美国;微软自研全双工AI语音模型曝光

    欢迎来到今天的AI日报!这里是你每天探索人工智能世界的指南,聚焦AI领域的热点内容,助你洞悉技术趋势、了解创新AI产品应用。 1、微软首款自研全双工AI语音模型曝光:听说并行,16种语言自由切换 微软正在测试其首款原生实时语音模型MAI Realtime,该模型支持16种语言和两种语音风格,实现了听说并行的全双工交互,打破了传统语音助手的轮次交替模式。 🗣️ 支持16种语言和两…

    2026年8月5日 AI 日报
  • AI日报:Qwen3.8-Max即将开源,DeepSeek V4-Flash性价比碾压GPT

    今天AI圈又热闹了,几条重要动态值得关注。 Qwen3.8-Max上线,下周开源 阿里通义千问发布了Qwen3.8-Max,这次主打真实办公场景和复杂任务执行。编程能力、长程任务处理都有明显提升,智能体在真实生产环境中的表现也更靠谱了。最重要的是,模型权重计划下周开源,开发者可以直接拿来二次开发。 DeepSeek V4-Flash API公测,性价比碾压GPT DeepSee…

    2026年8月4日
  • DeepSeek官方编程工具Harness内测招募,V4 Pro正式版即将登场

    DeepSeek最近动作频频。7月31日刚放出V4-Flash正式版,性能直追Opus 4.8,结果大招还在后面——V4 Pro正式版和官方配套的Harness编程工具已经在路上了。 Harness是什么? 简单来说,Harness就是DeepSeek版的"Codex"。如果说现在的DeepSeek App更像ChatGPT,主打聊天对话;那Harness就…

    2026年8月3日
  • AI日报:MiniMax发布全模态模型H3;Seedance 2.5支持30秒视频;DeepSeek-V4-Flash正式上线

    欢迎来到今天的AI日报!这里是你每天探索人工智能世界的指南,聚焦AI领域的热点内容,助你洞悉技术趋势、了解创新AI产品应用。 1、MiniMax发布通用全模态模型H3 MiniMax刚刚发布了通用全模态模型H3,这是一个能同时理解和生成文本、图像、视频、音频的全能选手。 亮点包括: 支持原生双声道音视频输出,最高可生成15秒2K分辨率内容 引入Contextual Omni R…

    2026年8月2日
  • AI日报:MiniMax发布全模态模型H3;Seedance 2.5支持30秒一镜到底;DeepSeek-V4-Flash正式上线

    欢迎来到今天的AI日报!这里是你每天探索人工智能世界的指南,聚焦AI领域的热点内容,助你洞悉技术趋势、了解创新AI产品应用。 1、MiniMax发布通用全模态模型H3,15秒2K音视频生成价格不到主流模型三分之一 MiniMax最近发布了他们的通用全模态模型H3,这个模型实现了文本、图像、视频、音频的统一理解与生成。这标志着多模态生成模型从专用专家向通用助手迈出了关键一步。 H…

    2026年8月2日
  • AI日报:MiniMax发布全模态模型H3,DeepSeek-V4-Flash正式版上线

    MiniMax刚刚发布了通用全模态模型H3,这个模型牛的地方在于它能同时处理文本、图像、视频和音频,实现了统一理解与生成。这意味着你不用再切换不同工具,一个模型搞定所有模态。 H3在广告、电商、游戏这些商业场景里已经能稳定输出,支持原生双声道音视频,最高能生成15秒2K分辨率的内容。更关键的是,MiniMax还打算开源这个模型,这对国内AI生态是个大利好。 字节跳动的Seeda…

    2026年8月2日
  • AI日报:MiniMax发布全模态模型H3;Seedance 2.5支持30秒一镜到底;DeepSeek-V4-Flash正式上线

    欢迎来到今天的AI日报!每天为你精选AI领域最值得关注的动态,帮你快速了解技术趋势和创新产品。 MiniMax发布通用全模态模型H3 MiniMax最近放了个大招——发布了通用全模态模型H3。这个模型牛在哪?它能同时理解并生成文本、图像、视频和音频,相当于一个”全能选手”。 以前的多模态模型大多是”专才”,有的擅长生图,有的擅长做…

    2026年8月1日
  • AI日报:MiniMax发布全模态模型H3;Seedance 2.5支持30秒一镜到底;DeepSeek-V4-Flash正式上线

    欢迎来到今天的AI日报!这里是你每天探索人工智能世界的指南,聚焦AI领域的热点内容,助你洞悉技术趋势、了解创新AI产品应用。 1、MiniMax发布通用全模态模型H3,15秒2K音视频生成价格不到主流模型三分之一 MiniMax最近放了个大招——发布通用全模态模型H3,实现了文本、图像、视频、音频的统一理解与生成。这标志着多模态生成模型从专用专家向通用助手迈出了关键一步。 H3…

    2026年8月1日