开源项目

  • OpenClaw 2.0 意外诞生:从简化安装到全面升级

      今天,OpenClaw 发布了有史以来最大的一次更新——OpenClaw 2.0。 🎉 史上最大更新发布 这次更新有多大规模? 933位贡献者参与开发,其中569位是首次贡献 包含超过 16,000 个拉取请求(PR) 这相当于 OpenClaw 历史上所有合并 PR 的 50% 👉 查看完整发布说明 🤔 为什么这次更新花了近两个月? 以前,OpenClaw 团队平均每 2…

    2026年8月31日
  • 商汤科技开源8B轻量多模态大模型:原生4K输出、全能视觉编辑

    商汤科技开源8B轻量多模态大模型:原生4K输出、全能视觉编辑 2026年8月21日前后,商汤科技正式开源了一款名为SenseNova U1.5 Lite(全称SenseNova-U1.5-8B-MoT)的轻量级多模态大模型。它参数量只有约80亿(8B),却能在一个统一模型里同时搞定视觉理解、推理、图像生成和精准编辑,还原生支持最高4K分辨率输出。简单说,它不是那种“理解归理解、…

    2026年8月22日
  • DeepSeek Harness v0.1 发布:Cordis 驱动的「一切皆插件」Agent 框架开源

    DeepSeek 今天开源了 Harness v0.1 开发者预览版——一个基于 Cordis 元框架构建的 AI Agent 框架,核心哲学就一句话:一切皆插件。 插件化到极致 不是说说而已。在 Harness 里: 模型是插件——今天用 DeepSeek,明天换 Claude,切换就行 工具是插件——需要啥能力就插啥 技能是插件——特定任务封装成可复用模块 会话、沙箱、文件…

    开源项目 2026年8月13日
  • 京东开源 JoyAI-Video-Edit:实时流式视频编辑,边播边改

    京东最近干了一件挺有意思的事——把自家研发的实时流式视频编辑模型 JoyAI-Video-Edit 开源了。 核心看点 边播边改:打破传统”先成片再剪辑”的模式,播放画面同步实时修改 性能够硬:720P 分辨率下稳定 30 帧实时运算,无明显延迟卡顿 超长视频支持:不间断流式处理,不是只能剪短视频片段 评测领先:OpenVE-Bench 上超越 SANA…

    开源项目 2026年8月5日
  • 京东开源JoyAI-Video-Edit:实时流式视频编辑,边播边改

    京东最近干了一件挺酷的事——把自己研发的实时视频编辑模型JoyAI-Video-Edit开源了。 这个模型的核心卖点是“边播边改”。传统视频编辑得先拍完、再剪辑、再渲染,整个过程费时费力。JoyAI-Video-Edit打破了这套流程,让你在视频播放的同时就能实时修改画面内容,而且是流式处理,不会因为视频太长就卡壳。 技术参数上,在720P分辨率下能稳定…

    开源项目 2026年8月5日
  • 小红书开源BigMac:把多模态训练的显存与速度,从二选一中解放出来

    多模态大模型训练长期存在一个让人头疼的矛盾:想省显存就得慢,想快就得烧显存。小红书开源的新方案BigMac,试图把这个问题从”二选一”变成”我全都要”。 BigMac的核心是一套多模态流水并行训练新范式。简单说,它通过一种叫准依赖安全的嵌套流水线设计,重新编排了训练过程中数据和模型的计算顺序,让GPU在同样的时间内干更多的活,还不…

    开源项目 2026年7月23日
  • 2.8万亿参数、100万词元上下文,Kimi K3把开源大模型的天花板顶到了全球最高

    2026年7月16日,就在2026世界人工智能大会(WAIC 2026)开幕前夕,月之暗面(Moonshot AI)突然投下一枚”模型核弹”——正式发布新一代旗舰模型 Kimi K3。这款拥有 2.8万亿参数 的模型,不仅是目前全球参数规模最大的开源大模型,更是开源阵营首次在体量上正面击穿闭源旗舰的”心理防线”。 一、2.8万亿参…

    2026年7月19日
  • 小米开源380亿参数具身大模型Xiaomi-Robotics-U0:生成效率提升83倍,拿下全球评测第一

    小米在机器人领域放了个大招。 7月15日,小米正式发布并全量开源了380亿参数的多模态自回归具身生成基础模型 Xiaomi-Robotics-U0。这是行业首个能统一覆盖四类核心具身生成任务的一体化方案,打破了以往机器人场景、轨迹、视频生成模型各自为政的局面。 四大能力一体化 这个模型同时承载了四项能力: 具身场景生成 具身轨迹迁移 机器人交互视频生成 通用文生图与图像编辑 它…

    2026年7月16日
  • 蚂蚁集团开源Avernet:多智能体协作有了新基础设施

    蚂蚁集团最近开源了 Avernet V0.1,这是一个专门解决多智能体协作问题的项目。如果你正在做多个AI Agent协同工作的系统,这个项目值得关注。 为什么需要Avernet? 现在的AI应用越来越复杂,单个Agent往往搞不定。但多个Agent协作时,又面临一堆问题:怎么通信?怎么分工?怎么达成共识? Avernet 的定位就是解决这些”协作层”的…

    开源项目 2026年7月7日
  • Skill-Omni:让AI Agent真正看懂图片的开源框架

    AI Agent 处理视觉任务一直是个难题。传统方式是让模型直接看图,但效果往往不理想。Skill-Omni 换了个思路——把视觉经验转化为可复用的技能。 视觉经验资产化 Skill-Omni 的核心创新在于将视觉信息转化为结构化的经验资产。不是让AI每次从零开始理解图片,而是把常见的视觉模式、标准、规范沉淀为可复用的Skill。 举个例子,如果你让AI检查产品设计图是否符合品…

    开源项目 2026年7月7日