推荐类别

栏目分类

优惠 如何将检索增强型生成(RAG)应用于大型视频库,以提高视频内容的检索和再利用效率

  • 如何将检索增强型生成(RAG)应用于大型视频库,以提高视频内容的检索和再利用效率
    AI
  • Moments Lab Research发布论文,论文的主题是探讨如何将检索增强型生成(RAG)应用于大型视频库,以提高视频内容的检索和再利用效率。简单来说,就是利用人工智能技术帮助视频创作者在海量视频资料中快速找到所需片 ...... 阅读全文

    优惠 使用大语言模型作为评估员(或“法官”)来评价其他语言模型的表现

  • 使用大语言模型作为评估员(或“法官”)来评价其他语言模型的表现
    AI
  • 马萨诸塞大学阿默斯特分校和Meta的研究人员发布论文,论文的主题是探讨使用大语言模型(LLMs)作为评估员(或“法官”)来评价其他语言模型的表现。这个概念很有前景,因为它解决了人类评估难以扩展到大规模语言模型的 ...... 阅读全文

    优惠 人工智能框架LongRAG:用于增强检索增强型生成模型(RAG)在处理长文本内容时的能力

  • 人工智能框架LongRAG:用于增强检索增强型生成模型(RAG)在处理长文本内容时的能力
    AI
  • 滑铁卢大学的研究人员推出新型的人工智能框架LongRAG,它用于增强检索增强型生成模型(Retrieval-Augmented Generation, RAG)在处理长文本内容时的能力。简单来说,LongRAG 通过改进传统的 RAG 框架,使其能够更有 ...... 阅读全文

    优惠 基于AI技术的照片地理定位工具GeoSpy.ai

  • 基于AI技术的照片地理定位工具GeoSpy.ai
    AI
  • GeoSpy.ai 是一款基于人工智能技术的照片地理定位工具,它能够通过分析用户上传的照片,利用计算机视觉和AI算法来推断照片的拍摄地点。用户只需访问其官方网站,上传需要定位的照片,GeoSpy.ai 便会自动进行分析,并 ...... 阅读全文

    优惠 阿里云智能编程辅助工具通义灵码登陆Visual Studio插件市场,个人专业版限时免费

  • 阿里云智能编程辅助工具通义灵码登陆Visual Studio插件市场,个人专业版限时免费
    AI
  • 阿里云最新力作——通义灵码,一款基于通义大模型的智能编码辅助工具,现已登陆微软Visual Studio插件市场。这款工具以其强大的实时续写、代码生成、优化、注释及智能问答等能力,支持Java、Python、Go、C++等超过200 ...... 阅读全文

    优惠 英国的免费图片和视频托管服务「ImgPile」

  • 英国的免费图片和视频托管服务「ImgPile」
    工具
  • 「ImgPile」是一个来自英国的免费空间,为用户提供了一个上传和分享图片及视频的平台。它承诺100%完全免费、无广告,并且没有第三方追踪器,保障用户隐私。「ImgPile」是一个注重隐私和便利性的服务,适合需要快速、 ...... 阅读全文

    优惠 新方法Whiteboard-of-Thought(思维白板):提升多模态大语言模型在视觉推理方面的能力

  • 新方法Whiteboard-of-Thought(思维白板):提升多模态大语言模型在视觉推理方面的能力
    AI
  • 哥伦比亚大学的研究人员推出新方法“Whiteboard-of-Thought”(思维白板,简称WoT),旨在提升多模态大语言模型(MLLMs)在视觉推理方面的能力。这种方法模仿了人类在解决视觉问题时的自然行为,即通过形成心理图像或 ...... 阅读全文

    优惠 新基准测试MMBench-Video:为视频理解而设计的长期多镜头视频问答(VideoQA)评估工具

  • 新基准测试MMBench-Video:为视频理解而设计的长期多镜头视频问答(VideoQA)评估工具
    AI
  • 上海人工智能实验室、上海交通大学、香港中文大学和同济大学的研究人员推出新基准测试MMBench-Video,它是一个为视频理解而设计的长期多镜头视频问答(VideoQA)评估工具。这个基准测试旨在全面评估大型视觉语言模型 ...... 阅读全文

    优惠 新框架Prism:专门设计用来解耦和评估视觉语言模型的两个关键能力:感知能力和推理能力

  • 新框架Prism:专门设计用来解耦和评估视觉语言模型的两个关键能力:感知能力和推理能力
    AI
  • 上海人工智能实验室、南京大学、香港中文大学、同济大学、南京邮电大学和中国科学技术大学的研究人员推出新框架Prism,它专门设计用来解耦和评估视觉语言模型(VLMs)的两个关键能力:感知能力和推理能力。Prism框架 ...... 阅读全文

    优惠 新型多模态数据集格式PIN:提升大型多模态模型在复杂知识驱动任务中的表现

  • 新型多模态数据集格式PIN:提升大型多模态模型在复杂知识驱动任务中的表现
    AI
  • 新型多模态数据集格式PIN(Paired and Interleaved multimodal documents,即配对和交错的多模态文档),这个格式旨在提升大型多模态模型(Large Multimodal Models,简称LMMs)在复杂知识驱动任务中的表现,尤其是 ...... 阅读全文

    优惠 新型优化方法iLR-DPO(迭代长度正则化的直接偏好优化):提升语言模型的性能,使其更符合人类的偏好和价值观

  • 新型优化方法iLR-DPO(迭代长度正则化的直接偏好优化):提升语言模型的性能,使其更符合人类的偏好和价值观
    AI
  • 香港中文大学MMLab和上海人工智能实验室推出一种新型的优化方法,名为迭代长度正则化的直接偏好优化(Iterative Length-Regularized Direct Preference Optimization,简称iLR-DPO)。这种方法主要用于提升语言模型 ...... 阅读全文

    优惠 多任务信息提取模型GLiNER:通过一个小规模的编码器(encoder)模型,实现对各种信息提取任务的有效处理

  • 多任务信息提取模型GLiNER:通过一个小规模的编码器(encoder)模型,实现对各种信息提取任务的有效处理
    AI
  • 新型的多任务信息提取模型GLiNER(Generalist Lightweight model for Information Extraction and Named Entity Recognition),这个模型旨在通过一个小规模的编码器(encoder)模型,实现对各种信息提取任务的有效 ...... 阅读全文
    我要爆料 我的收藏 顶部
    快速登录

    自动登录 忘记密码?