ai

  • 字节阿里腾讯集体转向:大厂AI进入基因驱动时代

    以前,国内大厂做AI喜欢跟着硅谷走。现在,字节、阿里、腾讯三巨头不约而同选择了另一条路——回到自己最擅长的东西,用基因驱动AI。 字节:重拾大力出奇迹 6月底,字节CEO梁汝波连续两次喊话:要求全力深耕AI、做有高度的事、敢于设定高目标。这熟悉的配方,正是字节当年做抖音、做今日头条的大力出奇迹方法论。 豆包没有学微信做小程序生态,也没有继续搞AI手机——两条路都被堵死了。它选择…

    行业/好文 2026年7月8日
  • 可灵AI估值180亿美元冲刺IPO:快手分拆背后的AI视频战争

    当OpenAI因为算力吃紧关掉Sora的时候,快手却给可灵AI谋了个完全不同的结局——分拆上市,估值180亿美元。 30亿美元Pre-IPO融资,刷新全球纪录 7月2日,快手在港交所公告:可灵AI完成Pre-IPO轮30亿美元融资,投后估值180亿美元(约1225亿人民币)。这个数字不仅刷新了全球视频大模型单轮融资纪录,也让可灵AI的估值达到了快手自身市值的75%以上。 投资方…

    行业/好文 2026年7月8日
  • AI短剧正在复活《山海经》:穷奇、烛龙们终于走向大众

    你能说出几个《山海经》里的异兽?说实话,大多数人脑子里蹦出来的可能是日本动漫里的九尾狐,而不是我们自己的穷奇、烛龙。 这事儿挺荒诞的。中国自己的文化宝库《山海经》《搜神记》《太平广记》,随便翻开一页都是绝佳素材,但几十年来大多安静躺在书架上。很多人第一次系统接触志怪文化,还是通过日本动漫。 AI打开了这道门 直到AI出现,情况开始改变。 抖音上,创作者@三木公HeSong 的《…

    2026年7月8日
  • AI日报:Claude Code v2.1.202更新;支付宝AI开放平台邀测;xAI升级Grok Voice

    今天AI圈又热闹了,Claude Code、支付宝、xAI都有新动作,还有几个有意思的开源项目值得关注。 Claude Code v2.1.202:远程协作更稳了 Claude Code 新版主要优化了三个地方: 动态工作流大小:可以自定义智能体规模,平衡任务复杂度和系统资源占用 远程控制稳定性:修复了命令发送失败、图片静默丢弃等问题,加了自动重试机制 /review 命令回归…

    2026年7月8日
  • AI短剧正让《山海经》异兽们走向大众:穷奇、夔牛、烛龙「复活」了

    AI短剧正让《山海经》异兽们走向大众:穷奇、夔牛、烛龙「复活」了AI短剧正让《山海经》异兽们走向大众:穷奇、夔牛、烛龙「复活」了AI短剧正让《山海经》异兽们走向大众:穷奇、夔牛、烛龙「复活」了AI短剧正让《山海经》异兽们走向大众:穷奇、夔牛、烛龙「复活」了

    你能说出几个《山海经》里的异兽名字? 仔细想想知道的不多,但脑子里可能是《火影忍者》里的九尾妖狐、《圣斗士星矢》里的冥界三巨头,或者是古希腊神话里的九头蛇海德拉、北欧神话里的灭世巨狼芬里尔…… 我们对外国神话异兽多少有点认知,却对自家那本厚厚的《山海经》说不出几个名字。 这事儿想想挺荒诞。中国自己的文化宝库《山海经》《搜神记》《太平广记》随便翻开一页都是…

    2026年7月8日 行业/好文
  • AI日报:Claude Code v2.1.202更新,支付宝AI开放平台开启邀测,xAI升级Grok Voice

    欢迎来到今天的AI日报!这里是你每天探索人工智能世界的指南,聚焦AI领域的热点内容,助你洞悉技术趋势、了解创新AI产品应用。 1、Claude Code 迎来 v2.1.202 更新:远程控制与工作流稳定性大幅提升 Claude Code v2.1.202 版本在工作流控制、远程协作和稳定性方面进行了深度优化,提升了开发者的使用体验和可靠性。 核心更新: 引入「动态工作流大小」…

    2026年7月8日
  • OfficeCLI开源:AI终于能看懂Word文档了

    AI处理办公文档一直是个痛点。PDF、Word、Excel这些格式,AI看起来就像天书。OfficeCLI的出现,可能会改变这个局面。 高保真HTML渲染引擎 OfficeCLI的核心是一个高保真HTML渲染引擎。它能把Word、Excel这些文档转换成AI能理解的HTML格式,而且保留原始的版式和结构。 这意味着什么?AI不仅能读到文档的文字内容,还能理解标题层级、表格结构、…

    应用 2026年7月7日
  • Skill-Omni:让AI Agent真正看懂图片的开源框架

    AI Agent 处理视觉任务一直是个难题。传统方式是让模型直接看图,但效果往往不理想。Skill-Omni 换了个思路——把视觉经验转化为可复用的技能。 视觉经验资产化 Skill-Omni 的核心创新在于将视觉信息转化为结构化的经验资产。不是让AI每次从零开始理解图片,而是把常见的视觉模式、标准、规范沉淀为可复用的Skill。 举个例子,如果你让AI检查产品设计图是否符合品…

    开源项目 2026年7月7日
  • 支付宝AI开放平台开启邀测:一次接入,多端分发

    支付宝最近搞了个大动作——AI开放平台开始邀测了。这意味着商家以后可以通过支付宝的智能体,一次接入就能覆盖多个终端。 跨端互联是核心卖点 支付宝这次的重点很明确:让商家的服务能够通过智能体实现多端分发和统一管理。简单说就是,你在支付宝上搭建一个智能体,用户可以在App、小程序、甚至第三方设备上都能用到。 对于商家来说,这省去了为每个平台单独开发的麻烦。一次开发,到处运行,这个诱…

    应用 2026年7月7日
  • Google AI连发两招:Nano Banana 2 Lite 4秒出图,SynthID升级守护AI内容真实性

    核心看点 Google AI在7月初连发两招:推出Nano Banana 2 Lite——号称”迄今为止最快且最具成本效益的Gemini图像模型”,可在4秒内生成图像;同时升级SynthID水印技术,为AI生成内容添加不可见的数字指纹。这两项更新直指当前AI领域的两大痛点:图像生成速度和内容真实性验证。 详细解析 Nano Banana 2 Lite:快…

    Google Gemini 2026年7月7日