推荐类别

栏目分类

优惠 PiT:更细致地理解图像内容,而不是依赖于局部区域的信息

  • PiT:更细致地理解图像内容,而不是依赖于局部区域的信息
    AI
  • Meta AI和阿姆斯特丹大学的研究人员发布论文,论文的核心主题是对现代计算机视觉架构中一个长期存在的假设——局部性(locality)的必要性提出质疑。局部性是指在图像处理中,相邻像素之间的关联性比相隔较远的像素要 ...... 阅读全文

    优惠 开源视觉-语言-动作模型OpenVLA:多才多艺的机器人大脑,它能够理解人类的语言指令

  • 开源视觉-语言-动作模型OpenVLA:多才多艺的机器人大脑,它能够理解人类的语言指令
    AI
  • 斯坦福大学、加州大学伯克利分校、丰田研究院、Google DeepMind和麻省理工学院推出OpenVLA,它是一个拥有7亿参数的视-语-行模型(Vision-Language-Action Model,简称VLA)。简单来说,OpenVLA就像是一个多才多艺的 ...... 阅读全文

    优惠 偏好优化算法DiscoPOP:用于改善和控制大型语言模型输出的质量,使其更好地符合人类的价值观和偏好

  • 偏好优化算法DiscoPOP:用于改善和控制大型语言模型输出的质量,使其更好地符合人类的价值观和偏好
    AI
  • Sakana AI 与 剑桥大学、牛津大学的研究人员推出DiscoPOP,如何使用大语言模型来自动发现和优化偏好优化算法。偏好优化算法主要用于改善和控制大型语言模型输出的质量,使其更好地符合人类的价值观和偏好。例如,我 ...... 阅读全文

    优惠 数据集Recap-DataComp:使用LLaMA-3重新描述网络上的数十亿图像

  • 数据集Recap-DataComp:使用LLaMA-3重新描述网络上的数十亿图像
    AI
  • 加州大学圣克鲁斯分校、爱丁堡大学、 JHU、 Adob​​e、和UT 奥斯汀的研究人员发布论文,论文的主题是关于如何使用一个名为LLaMA-3的先进语言模型来重新描述(recaption)网络上的数十亿图像,目的是改善图像与其文字 ...... 阅读全文

    优惠 能够理解多种信息形式(比如文本、图像、视频、声音等)的全能型人工智能模型MiCo

  • 能够理解多种信息形式(比如文本、图像、视频、声音等)的全能型人工智能模型MiCo
    AI
  • 香港中文大学多媒体实验室、中国科学院大学人工智能学院、中国科学院自动化研究所和上海人工智能实验室的研究人员推出全能型人工智能模型MiCo,这是一种能够理解多种信息形式(比如文本、图像、视频、声音等)的全能 ...... 阅读全文

    优惠 综合性基准测试工具CS-Bench:专门设计用来评估大语言模型在计算机科学(CS)领域的性能

  • 综合性基准测试工具CS-Bench:专门设计用来评估大语言模型在计算机科学(CS)领域的性能
    AI
  • 北京邮电大学推出综合性基准测试工具CS-Bench,它专门设计用来评估大语言模型(LLMs)在计算机科学(CS)领域的性能。CS-Bench是首个中英双语的计算机科学评估基准,旨在全面考察LLMs在计算机科学各个方面的知识和推 ...... 阅读全文

    优惠 Visual SKETCHPAD:赋予了多模态语言模型一种新的可视化工具——素描板,以及在素描板上绘图的能力

  • Visual SKETCHPAD:赋予了多模态语言模型一种新的可视化工具——素描板,以及在素描板上绘图的能力
    AI
  • 华盛顿大学、艾伦人工智能研究所和 宾夕法尼亚大学的研究人员推出Visual SKETCHPAD,它赋予了多模态语言模型(LMs)一种新的可视化工具——素描板,以及在素描板上绘图的能力。这就像给计算机一个可以在上面画草图的画 ...... 阅读全文

    优惠 新基准测试TC-Bench:用来评估和比较不同的视频生成模型在处理时间维度上组合性的能力

  • 新基准测试TC-Bench:用来评估和比较不同的视频生成模型在处理时间维度上组合性的能力
    AI
  • 加州大学圣巴巴拉分校和滑铁卢大学的研究人员推出新基准测试TC-Bench,它专门用来评估和比较不同的视频生成模型在处理时间维度上组合性的能力。这里的“时间组合性”意味着视频中的物体或者场景能够随着时间变化而展现 ...... 阅读全文

    优惠 新框架LMC:用于对大语言模型在高度主观任务上的表现进行基准测试

  • 新框架LMC:用于对大语言模型在高度主观任务上的表现进行基准测试
    AI
  • Predibase、博科尼大学的研究人员推出新框架“Language Model Council”(LMC),用于对大语言模型(LLMs)在高度主观任务上的表现进行基准测试。这个框架通过民主化的过程来评估和排名模型,尤其是在情感智能、创造性 ...... 阅读全文

    优惠 大型3D重建模型LRM-Zero:完全使用合成的3D数据进行训练,以实现高质量的稀疏视图3D重建

  • 大型3D重建模型LRM-Zero:完全使用合成的3D数据进行训练,以实现高质量的稀疏视图3D重建
    AI
  • Adob​​e 研究 、石溪大学和基尔大学的研究人员推出大型3D重建模型LRM-Zero,它完全使用合成的3D数据进行训练,以实现高质量的稀疏视图3D重建。LRM-Zero的核心是名为Zeroverse的过程化3D数据集,这个数据集通过简单的 ...... 阅读全文

    优惠 新型基准测试工具MUIRBENCH:用来评估多模态大语言模型在理解多图像方面的能力

  • 新型基准测试工具MUIRBENCH:用来评估多模态大语言模型在理解多图像方面的能力
    AI
  • 南加州大学、宾大、明尼苏达大学、加州大学戴维斯分校、威斯康星大学麦迪逊分校、加州大学洛杉矶分校、俄亥俄州立大学、字节跳动和微软研究院的研究人员推出新型基准测试工具MUIRBENCH,它专门用来评估多模态大型语 ...... 阅读全文

    优惠 大型多语言多模态文档级语料库mOSCAR

  • 大型多语言多模态文档级语料库mOSCAR
    AI
  • 来自Inria 、法国国立科学研究院、巴黎政治大学、巴黎圣日耳曼大学信息科学系、法国国立科学研究院、巴黎政治大学信息科学发展与资源研究所、法国巴黎索邦大学、 通用爬行基金会和巴黎萨克雷大学的研究人员推出大型 ...... 阅读全文
    我要爆料 我的收藏 顶部
    快速登录

    自动登录 忘记密码?