AI

优惠 新型三维场景重建框架ReconX:从稀疏的视角(比如只有几张图片)重建出详细的三维场景

  • 新型三维场景重建框架ReconX:从稀疏的视角(比如只有几张图片)重建出详细的三维场景
    AI
  • 清华大学和香港科技大学的研究人员推出新型三维场景重建框架ReconX,econX的目标是从稀疏的视角(比如只有几张图片)重建出详细的三维场景。这就像用几张风景照片,来构建一个可以360度观看的三维模型。 项目主页:h ...... 阅读全文

    优惠 智谱AI和清华大学联合推出新型视觉语言模型家族CogVLM2:专门设计用于理解和处理图像与视频内容

  • 智谱AI和清华大学联合推出新型视觉语言模型家族CogVLM2:专门设计用于理解和处理图像与视频内容
    AI
  • 智谱AI和清华大学联合推出新型视觉语言模型家族CogVLM2,它们专门设计用于理解和处理图像与视频内容。简单来说,这些模型就像是拥有超凡视觉能力的智能助手,它们不仅能“看到”图像和视频里的内容,还能理解这些内容 ...... 阅读全文

    优惠 AnythingLLM :可以在本地电脑一件运行大语言模型的跨平台桌面客户端

  • AnythingLLM :可以在本地电脑一件运行大语言模型的跨平台桌面客户端
    AI
  • AnythingLLM 是一款可以在本地电脑一件运行大语言模型的跨平台桌面客户端,支持 Windows、macOS、Linux,支持自选模型,也可以从软件内下载模型。它还支持嵌入模型、语音、转录,最重要的是可以实现完全离线,不依托 ...... 阅读全文

    优惠 TEDRA:让用户通过文本描述来编辑动态且逼真的3D角色模型

  • TEDRA:让用户通过文本描述来编辑动态且逼真的3D角色模型
    AI
  • 马克斯·普朗克信息学研究所,萨尔信息学校区、萨尔布吕肯视觉计算、交互和人工智能研究中心和弗莱堡大学的研究人员推出TEDRA,它可以让用户通过文本描述来编辑动态且逼真的3D角色模型。简单来说,TEDRA就是一个先进 ...... 阅读全文

    优惠 新型机器人学习模型ICRT:通过一种新颖的“在上下文中学习”方法,让机器人能够在没有额外训练的情况下,通过理解输入的上下文信息来执行新任务

  • 新型机器人学习模型ICRT:通过一种新颖的“在上下文中学习”方法,让机器人能够在没有额外训练的情况下,通过理解输入的上下文信息来执行新任务
    AI
  • 加州大学伯克利分校和Autodesk的研究人员推出新型机器人学习模型ICRT,ICRT的核心目标是通过一种新颖的“在上下文中学习”(in-context learning)方法,让机器人能够在没有额外训练的情况下,通过理解输入的上下文信 ...... 阅读全文

    优惠 新型框架LLaVA-MoD:通过专家混合(MoE)知识蒸馏技术使大型多模态语言模型变得小型化

  • 新型框架LLaVA-MoD:通过专家混合(MoE)知识蒸馏技术使大型多模态语言模型变得小型化
    AI
  • 阿里巴巴、香港中文大学、香港感知与交互智能研究中心和北京航空航天大学的研究人员推出新型框架LLaVA-MoD,通过专家混合(MoE)知识蒸馏技术使大型多模态语言模型(MLLM)变得小型化。简单来说,LLaVA-MoD的目标是 ...... 阅读全文

    优惠 多模态大语言模型EAGLE:专门设计用于提升模型在处理视觉信息时的能力

  • 多模态大语言模型EAGLE:专门设计用于提升模型在处理视觉信息时的能力
    AI
  • 英伟达、佐治亚理工学院、UMD和香港理工大学的研究人员推出多模态大语言模型EAGLE,专门设计用于提升模型在处理视觉信息时的能力。简单来说,EAGLE项目的目标是让语言模型能够更好地“看懂”和理解图片,并将这些视觉 ...... 阅读全文

    优惠 Nexa AI推出新型语言模型架构Dolphin:为节能的长文本处理而设计

  • Nexa AI推出新型语言模型架构Dolphin:为节能的长文本处理而设计
    AI
  • Nexa AI推出新型语言模型架构Dolphin,它专为节能的长文本处理而设计,尤其适用于设备上的模型(on-device models)。想象一下,如果你的手机或智能手表需要处理大量的文本数据,比如翻译一篇长文章或者回答关于复杂 ...... 阅读全文

    优惠 BaichuanSEED:通过精细的预训练和微调策略,实现了与行业领先模型相当的性能

  • BaichuanSEED:通过精细的预训练和微调策略,实现了与行业领先模型相当的性能
    AI
  • 大语言模型(LLM)的通用能力高度依赖于广泛预训练数据集的组成和选择,这些数据集通常被视为多个机构的商业机密。为了解决这一问题,百川开源了一种适用于所有场景的数据处理流程的细节,并通过引入一个竞争力强的L ...... 阅读全文

    优惠 阿里巴巴推出新型文本阅读模型Platypus:能够从各种形式的图像中读取文本,无论是自然场景还是文档

  • 阿里巴巴推出新型文本阅读模型Platypus:能够从各种形式的图像中读取文本,无论是自然场景还是文档
    AI
  • 阿里巴巴推出新型文本阅读模型Platypus,它能够从各种形式的图像中读取文本,无论是自然场景还是文档。这个模型的设计理念是结合专家模型(specialist models)的高精度和通用模型(generalist models)的广泛适用性 ...... 阅读全文

    优惠 交互式3D布局控制方法“Build-A-Scene(BAS)”

  • 交互式3D布局控制方法“Build-A-Scene(BAS)”
    AI
  • 沙特阿拉伯国王科技大学的研究人员推出交互式3D布局控制方法“Build-A-Scene”(简称BAS),用于基于扩散模型的图像生成。简单来说,这个方法允许用户通过提供一个3D布局来控制图像中物体的类型、位置和方向,然后系统 ...... 阅读全文

    优惠 新型AI游戏引擎GameNGen:完全由神经网络模型驱动,能够实现与复杂环境的实时交互,并且能够在长时间内保持高质量

  • 新型AI游戏引擎GameNGen:完全由神经网络模型驱动,能够实现与复杂环境的实时交互,并且能够在长时间内保持高质量
    AI
  • 特拉维夫大学和谷歌的研究人员推出新型游戏引擎GameNGen,它完全由神经网络模型驱动,能够实现与复杂环境的实时交互,并且能够在长时间内保持高质量。简单来说,GameNGen就像是一个智能的虚拟世界构建者,它可以在极 ...... 阅读全文