模型框架

  • 苹果也开始学 Meta,完全开源了 OpenELM 一系列模型,包括270M、450M、1.1B和3B四个规模的模型

    苹果公司在人工智能领域迈出了重要的一步,通过开源OpenELM系列模型,展示了其对开放科学和共享资源的承诺。以下是对苹果这一举措的优化文案: **苹果公司推动AI开放创新,开源OpenELM系列模型** 苹果公司最近宣布了一个重大的人工智能开源项目——OpenELM,这一系列模型包括了从270M到3B不等规模的多个模型。这一举措不仅为AI研究和开发社区带来了前所未有的资源,也体…

    2024年4月25日
  • 中文聊天模型Llama3-8B-Chinese-Chat发布

    Llama3-8B-Chinese-Chat 是一个专为中文优化的聊天模型,基于 Meta-Llama-3-8B-Instruct 模型并通过 ORPO 进行微调。该模型显著减少了中文问题英文回答以及回答中中英文混合的现象,同时减少了回答中表情符号的使用,使得回答更加正式。 User: 我的蓝牙耳机坏了,我该去看牙科还是耳鼻喉科? Assistant: 很抱歉听到你的蓝牙耳机出…

    2024年4月23日
  • Meta 发布号称是最强大的开源大语言模型:Llama 3

    Meta 公司发布了新闻稿,宣布推出下一代大语言模型 Llama 3,共有 80 亿和 700 亿参数两种版本,号称是最强大的开源大语言模型。Llama 3 具有更强的推理能力和服从指令能力,并且能够处理文本、图片和视频。Meta 公司还发布了新的信任和安全工具,即将在 Facebook、Instagram、WhatsApp 等应用中整合 Llama 3。 地址: https:…

    2024年4月19日
  • MiniMax发布万亿MoE模型abab 6.5,包含abab 6.5和abab 6.5s两个模型

    国内 AI 初创企业 MiniMax正式推出abab 6.5系列模型,包含abab 6.5和abab 6.5s两个模型。万亿MoE模型abab 6.5支持200k tokens的上下文长度,在各类核心能力测试中,开始接近GPT-4、Claude 3 Opus、Gemini 1.5 Pro等世界领先的大语言模型的性能。abab 6.5s跟abab 6.5使用了同样的训练技术和数据…

    2024年4月17日
  • 360 开源了 360 智脑 7B(70 亿参数模型)支持 50 万字长文本输入

    360 公司日前在 GitHub 上开源了 360 智脑 7B(70 亿参数模型)。360 智脑大模型采用 3.4 万亿 Tokens 的语料库训练,以中文、英文、代码为主,开放 4K、32K、360K 三种不同文本长度。360 表示,360K(约 50 万字)是当前国产开源模型文本长度最长的。 地址: https://github.com/Qihoo360/360zhinao

    2024年4月13日
  • 马斯克的xAI再次推出首个多模态模型 Grok-1.5 Vision 可将流程图转成 Python 代码

    1. **游戏概述**:– 这是一个猜数字游戏,其中计算机生成一个1到10之间的随机数,用户需要猜测这个数字。 2. **代码实现**:– 文章提供了一个Python函数`guess_number()`,该函数实现了游戏的核心逻辑。– 首先,使用`random.randint(1, 10)`生成一个1到10之间的随机整数作为目标数字(`tar…

    2024年4月13日
  • Ferret-UI:苹果开发出能“看懂”手机屏幕上并能执行任务的多模态模型

    根据提供的PDF文档内容,以下是对”Ferret-UI: Grounded Mobile UI Understanding with Multimodal LLMs”论文的归纳总结: 1. **研究背景**:– 移动应用程序已成为日常生活中的重要组成部分,但现有的多模态大型语言模型(MLLMs)在理解和与用户界面(UI)屏幕有效交互方面存在不…

    2024年4月10日
  • MagicTime:可以生成延时视频的模型

    MagicTime:可以生成延时视频的模型MagicTime:可以生成延时视频的模型MagicTime:可以生成延时视频的模型MagicTime:可以生成延时视频的模型

    1. **项目背景**:– MagicTime是由北京大学、罗切斯特大学、新加坡国立大学、广东工业大学和加州大学圣克鲁斯分校共同研发的项目。– 该项目旨在生成高质量的变化时延视频(metamorphic videos),这些视频能够展示物体随时间变化的过程。 2. **研究问题**:– 现有的文本到视频生成(Text-to-Video, T2…

    2024年4月10日 模型框架
  • Mistral AI 开源了 Mistral 8X22B 模型,发布磁力链(262 GB)

    地址: magnet:?xt=urn:btih:9238b09245d0d8cd915be09927769d5f7584c1c9&dn=mixtral-8x22b&tr=udp%3A%2F%http://2Fopen.demonii.com%3A1337%2Fannounce&tr=http%3A%2F%http://2Ftracker.opentrac…

    2024年4月10日
  • 谷歌推出 Gemini 1.5 Pro 公共预览版 ,支持处理音频

    根据提供的网页内容,以下是对谷歌Gemini 1.5 Pro模型免费开放的归纳总结: 1. **对外开放**:谷歌的最强大模型Gemini 1.5 Pro已经全面对外开放,目前完全免费供开发者和普通用户使用。 2. **使用方式**:开发者可以通过API调用的方式使用Gemini 1.5 Pro,而普通用户可以直接在谷歌AI Studio中体验该模型。 3. **音频理解功能*…

    2024年4月10日