推荐类别

栏目分类

优惠 ClotheDreamer:根据文本提示生成高保真的3D服装资产

  • ClotheDreamer:根据文本提示生成高保真的3D服装资产
    AI
  • 上海大学、上海交通大学、复旦大学和腾讯优图实验室的研究人员推出创新系统ClotheDreamer,它能够根据文本提示生成高保真的3D服装资产。你只需要用文字描述你想要的衣服样式,比如“一件银色的蓬松夹克和相配的裤子” ...... 阅读全文

    优惠 新型交互式真实机器人动作模拟器IRASim:利用生成模型的能力,从给定的初始帧和动作轨迹生成极其逼真的机器人臂部执行动作的视频

  • 新型交互式真实机器人动作模拟器IRASim:利用生成模型的能力,从给定的初始帧和动作轨迹生成极其逼真的机器人臂部执行动作的视频
    AI
  • 字节跳动研究院和香港科技大学的研究人员推出新型交互式真实机器人动作模拟器IRASim,这个模拟器的核心功能是利用生成模型的能力,从给定的初始帧和动作轨迹生成极其逼真的机器人臂部执行动作的视频。简单来说,IRAS ...... 阅读全文

    优惠 字节跳动推出新型大语言模型video-SALMONN:专门设计用于增强视频理解能力,尤其是通过语音增强的音频-视觉模型

  • 字节跳动推出新型大语言模型video-SALMONN:专门设计用于增强视频理解能力,尤其是通过语音增强的音频-视觉模型
    AI
  • 字节跳动推出新型大语言模型video-SALMONN,它专门设计用于增强视频理解能力,尤其是通过语音增强的音频-视觉(av-LLM)模型。简单来说,video-SALMONN就像一个超级智能的“视频助手”,它不仅能“看”懂视频里的画面, ...... 阅读全文

    优惠 拥有8亿参数的医疗语言模型Llama-3-Physician-8B-Instruct

  • 拥有8亿参数的医疗语言模型Llama-3-Physician-8B-Instruct
    AI
  • 北京大学、香港科技大学和麻省理工学院-IBM Watson AI 实验室的研究人员推出Llama-3-Physician-8B-Instruct,这是一个拥有8亿参数的医疗语言模型。该模型是基于Llama 3构建的,并首先在RefinedWeb数据集中的高质量医 ...... 阅读全文

    优惠 投机性解码:提高大语言模型在多语言环境中的推理速度

  • 投机性解码:提高大语言模型在多语言环境中的推理速度
    AI
  • 韩国科学技术研究院和KT的研究人员推出“投机性解码”(Speculative Decoding),提高大语言模型(LLMs)在多语言环境中的推理速度,通过这种方法,可以显著加快模型在多语言设置下的推理时间。论文还提到,通过这种方 ...... 阅读全文

    优惠 Google DeepMind推出新型策略WARP:用于通过人类反馈进行强化学习(RLHF)以对大语言模型进行对齐

  • Google DeepMind推出新型策略WARP:用于通过人类反馈进行强化学习(RLHF)以对大语言模型进行对齐
    AI
  • Google DeepMind推出新型策略WARP(Weight Averaged Rewarded Policies),用于通过人类反馈进行强化学习(RLHF)以对大型语言模型(LLMs)进行对齐。这种策略的目的是在使用人类偏好训练的奖励模型来优化语言模型时 ...... 阅读全文

    优惠 以视觉为中心的方法设计!多模态大语言模型系列Cambrian-1

  • 以视觉为中心的方法设计!多模态大语言模型系列Cambrian-1
    AI
  • 纽约大学的研究人员推出多模态大语言模型系列Cambrian-1,这些模型采用以视觉为中心的方法设计。多模态大型语言模型结合了视觉和语言能力,旨在更好地理解和生成与图像和文本相关的信息。Cambrian-1的研究不仅达到了 ...... 阅读全文

    优惠 D-MERIT数据集:信息检索(IR)模型的评估方法

  • D-MERIT数据集:信息检索(IR)模型的评估方法
    AI
  • 亚马逊研究院、巴伊兰大学和艾伦人工智能研究所推出D-MERIT数据集,关于信息检索(Information Retrieval,简称IR)模型的评估方法。信息检索模型的任务是在一个大型的文档集合中,根据用户提出的查询(query),找 ...... 阅读全文

    优惠 评估基准BigCodeBench:用来测试大型编程语言模型在代码生成方面的能力

  • 评估基准BigCodeBench:用来测试大型编程语言模型在代码生成方面的能力
    AI
  • 评估基准BigCodeBench,它专门用来测试大型编程语言模型(LLMs)在代码生成方面的能力。这个基准通过设计具有多种功能调用和复杂指令的编程任务,来挑战和评估这些模型是否能够像人类开发者一样解决实际的编程问题。 ...... 阅读全文

    优惠 开源项目reveal-md:允许用户使用 Markdown 编写演示文稿,并通过 reveal.js 框架将其转换为 HTML 格式

  • 开源项目reveal-md:允许用户使用 Markdown 编写演示文稿,并通过 reveal.js 框架将其转换为 HTML 格式
    工具
  • reveal-md 是一个开源项目,它允许用户使用 Markdown 编写演示文稿,并通过 reveal.js 框架将其转换为 HTML 格式,从而在浏览器中进行展示。该项目在 GitHub 上的标星数量达到了 2.1K,表明其在开发者中有一定的受欢 ...... 阅读全文

    优惠 全面基准测试工具VideoHallucer:专门用来检测和评估LVLMs在视频理解任务中的幻觉问题

  • 全面基准测试工具VideoHallucer:专门用来检测和评估LVLMs在视频理解任务中的幻觉问题
    AI
  • 北京通用人工智能研究院、通用人工智能国家重点实验室、北京大学和加州大学圣克鲁斯分校推出全面基准测试工具VideoHallucer,专门用来检测和评估LVLMs在视频理解任务中的幻觉问题。所谓“幻觉”,指的是这些模型在理解 ...... 阅读全文

    优惠 多模态模型LongVA:更好地理解和处理非常长的视频序列

  • 多模态模型LongVA:更好地理解和处理非常长的视频序列
    AI
  • LMMs 实验室团队、 新加坡南洋理工大学和新加坡科技大学的研究人员推出Long Video Assistant(LongVA)模型,让大型多模态模型(LMMs)更好地理解和处理非常长的视频序列。这里的“长视频”指的是视频帧数很多,可能达 ...... 阅读全文
    我要爆料 我的收藏 顶部
    快速登录

    自动登录 忘记密码?