推荐类别

栏目分类

优惠 新型基准测试MMWorld:为了全面评估多模态大语言模型在视频理解方面的能力而设计

  • 新型基准测试MMWorld:为了全面评估多模态大语言模型在视频理解方面的能力而设计
    AI
  • 新型基准测试MMWorld,它是为了全面评估多模态大语言模型(MLLMs)在视频理解方面的能力而设计的。MLLMs是一类能够处理和理解图像、文本和视频等多种模态输入的人工智能模型。MMWorld通过提供丰富的视频内容和相关问 ...... 阅读全文

    优惠 视频大语言模型VideoLLaMA 2:为了提升视频和音频导向任务中的空间-时间建模和音频理解能力而设计

  • 视频大语言模型VideoLLaMA 2:为了提升视频和音频导向任务中的空间-时间建模和音频理解能力而设计
    AI
  • 阿里巴巴集团达摩院推出视频大语言模型VideoLLaMA 2,它是为了提升视频和音频导向任务中的空间-时间建模和音频理解能力而设计的。例如,你想让一个人工智能系统观看一段视频并回答有关视频内容的问题,或者描述视频 ...... 阅读全文

    优惠 大规模数据集3D-GRAND:为了提升三维语言模型的理解和减少幻觉而设计

  • 大规模数据集3D-GRAND:为了提升三维语言模型的理解和减少幻觉而设计
    AI
  • 密歇根大学和 纽约大学的研究人员推出大规模数据集3D-GRAND,它是为了提升三维语言模型(3D-LLMs)的理解和减少幻觉(hallucination,即模型错误地生成不存在的对象或信息)而设计的。例如,你有一个智能助手,它能 ...... 阅读全文

    优惠 视频编辑框架NaRCan:能够生成高质量的自然规范图像,以代表输入视频

  • 视频编辑框架NaRCan:能够生成高质量的自然规范图像,以代表输入视频
    AI
  • 阳明交通大学推出视频编辑框架NaRCan,它能够生成高质量的自然规范图像(canonical images),以代表输入视频。这些规范图像非常适合用于各种视频编辑任务,比如风格转换、动态分割和手写等。NaRCan在多个视频编辑任 ...... 阅读全文

    优惠 新型二维状态空间模型Chimera:专门用于有效建模多变量时间序列数据

  • 新型二维状态空间模型Chimera:专门用于有效建模多变量时间序列数据
    AI
  • 康奈尔大学计算机科学系和纽约大学格罗斯曼医学院的研究人员推出新型二维状态空间模型Chimera,它专门用于有效建模多变量时间序列数据。这类数据广泛存在于医疗保健、金融市场、能源管理等领域。例如,你是一名医生 ...... 阅读全文

    优惠 新颖方法Turbo Sparse:能够在保持模型性能的同时,显著减少每次推理迭代中激活的参数数量

  • 新颖方法Turbo Sparse:能够在保持模型性能的同时,显著减少每次推理迭代中激活的参数数量
    AI
  • 上海交通大学并行与分布式系统研究所(IPADS)、清华大学计算机科学与技术系和上海人工智能实验室的研究人员推出新颖方法Turbo Sparse,能够在保持模型性能的同时,显著减少每次推理迭代中激活的参数数量。提高大型 ...... 阅读全文

    优惠 PowerInfer-2:在智能手机上实现大语言模型的高速推理,特别是对于那些模型大小超出设备内存容量的情况

  • PowerInfer-2:在智能手机上实现大语言模型的高速推理,特别是对于那些模型大小超出设备内存容量的情况
    AI
  • 上海交通大学推出PowerInfer-2,它的主要目标是在智能手机上实现大语言模型(LLMs)的高速推理,特别是对于那些模型大小超出设备内存容量的情况。PowerInfer-2是第一个能够在智能手机上以每秒11.68个token的速度运行 ...... 阅读全文

    优惠 新型3D绘画技术Consistency2:利用潜在一致性模型来加速和改进3D模型表面的纹理绘制

  • 新型3D绘画技术Consistency2:利用潜在一致性模型来加速和改进3D模型表面的纹理绘制
    AI
  • 苏黎世联邦理工学院推出新型3D绘画技术Consistency2,这项技术的核心是利用潜在一致性模型(Latent Consistency Models, LCM)来加速和改进3D模型表面的纹理绘制。想象一下,如果你是一名3D艺术家,想要给一个3D模型 ...... 阅读全文

    优惠 ICE:解决大语言模型在知识编辑场景中的脆弱性问题

  • ICE:解决大语言模型在知识编辑场景中的脆弱性问题
    AI
  • 通用人工智能国家重点实验室 BIGAI、北京大学推出新方法“Consistent In-Context Editing”(简称ICE),旨在解决大语言模型在知识编辑场景中的脆弱性问题。在这些场景中,模型需要在不进行大量重新训练的情况下,整合 ...... 阅读全文

    优惠 合作游戏和数据集“PyQTax”:解决大语言模型在处理表格问答(TableQA)任务时面临的挑战

  • 合作游戏和数据集“PyQTax”:解决大语言模型在处理表格问答(TableQA)任务时面临的挑战
    AI
  • 摩根大通人工智能研究推出一个名为“HiddenTables”的合作游戏和数据集“PyQTax”,旨在解决大语言模型(LLMs)在处理表格问答(TableQA)任务时面临的挑战,同时确保数据隐私和规模化应用。例如,有一个包含员工信息的 ...... 阅读全文

    优惠 专注于东南亚语言的多语言多模态数据集中心和基准测试套件SEACrowd

  • 专注于东南亚语言的多语言多模态数据集中心和基准测试套件SEACrowd
    AI
  • 多语言多模态数据集中心和基准测试套件SEACrowd,它专注于东南亚语言。东南亚是一个语言和文化极其丰富多样的地区,拥有超过1300种本土语言和约6.71亿人口。然而,现有的人工智能(AI)模型在处理这些语言时面临着数 ...... 阅读全文

    优惠 新型基准测试VideoGUI:专门用于评估图形用户界面(GUI)自动化助手

  • 新型基准测试VideoGUI:专门用于评估图形用户界面(GUI)自动化助手
    AI
  • 新加坡国立大学和 微软的研究人员推出新型基准测试VideoGUI,它专门用于评估图形用户界面(GUI)自动化助手。GUI自动化是指让计算机程序自动执行图形界面中的操作,比如点击按钮、输入文字、拖拽对象等,这在很多领 ...... 阅读全文
    我要爆料 我的收藏 顶部
    快速登录

    自动登录 忘记密码?