猫眼电影
猫眼电影记者 杨百昌 报道首次登录送91元红包
大模型最广泛的应用如 ChatGPT、Deepseek、千问、豆包、Gemini 等通常会连接互联网进行检索增强生成(RAG)来产生用户问题的答案。随着多模态大模型(MLLMs)的崛起,大模型的主流技术之一 RAG 迅速向多模态发展,形成多模态检索增强生成(MM-RAG)这个新兴领域。ChatGPT、千问、豆包、Gemini 都开始允许用户提供文字、图片等多种模态的输入。
然而,目前对于 MM-RAG 的应用和研究都还处于非常初级的阶段,现有的 MM-RAG 研究以及综述论文主要聚焦于文本和图像等少数模态组合;音频、视频、代码、表格、知识图谱、3D 对象等多种模态的组合均可用于检索增强生成,却仅有很少的探索和研究。这使得研究者和开发者难以全面把握 MM-RAG 的技术脉络和广阔的应用空间。
来自华中科技大学、复旦大学、中国电信、美国伊利诺伊大学芝加哥分校的研究者们共同发布了一篇全面覆盖几乎所有模态作为输入和输出组合的MM-RAG综述来全面且系统化地阐述这个广阔的研究和应用空间。
论文标题:A Comprehensive Survey on Multimodal RAG: All Combinations of Modalities as Input and OutputTechRxiv: https://doi.org/10.36227/techrxiv.176341513.38473003/v2GitHub 项目主页: https://github.com/INTREBID/Awesome-MM-RAG
该论文的最大亮点在于其前所未有的广度:
它首次覆盖了几乎所有可能使用的模态组合作为输入和输出,包括文本、图像、音频、视频、代码、表格、知识图谱、3D 对象等。
通过这种全面的梳理,作者们首先揭示了 MM-RAG 领域中庞大的潜在输入 - 输出模态组合空间,并指出了其中尚未被充分探索的空白(如表 1 所示)。在作者提出的 54 种潜在组合中,目前只有 18 种组合存在已有研究(表 1 中绿色对勾的格子),许多极具应用价值的组合 —— 例如 “文本 + 视频作为输入,生成视频作为输出”—— 仍是一片亟待开拓的蓝海。
表 1:基于输入 - 输出模态组合的 MM-RAG 分类法
在此基础上,作者们构建了一个基于输入 - 输出模态组合的全新 MM-RAG 分类法,不仅系统性地组织了现有研究,还清晰展示了不同 MM-RAG 系统的核心技术组件(如表 2 所示),为后续研究提供了统一框架和方法参考。
表 2不同输入输出模态下多模态 RAG 的核心技术组件、任务和应用
四大关键阶段剖析 MM-RAG 工作流
基于这个新的分类法,该综述深入分析了MM-RAG系统的工作流程,并将其划分为四个关键阶段(如图 1 所示):
图 1 MM-RAG 的工作流
a)预检索 (Pre-retrieval): 数据组织和查询的准备工作。
b)检索 (Retrieval): 高效准确地从海量多模态知识库中找到相关信息。
c)增强 (Augmentation): 将检索到的多模态信息有效地融入到大模型中。
d)生成 (Generation): 根据输入和增强信息生成高质量的多模态输出。
论文详细总结了每个阶段的常用方法,并讨论了对于不同模态针对性的优化策略,为构建高性能的MM-RAG系统提供了实用的技术指导。
一站式指南:
训练、评估与应用前瞻
除了技术流程,该综述还提供了构建 MM-RAG 系统的一站式指南:
训练策略: 讨论了 MM-RAG 系统的训练方法,以最大化其检索和生成能力。评估方法: 总结了现有的MM-RAG 评估指标和 Benchmark,帮助研究者评估系统性能。应用与未来: 探讨了 MM-RAG 在多个领域的潜在应用,并指出了未来的重要研究方向。
作为首个覆盖所有常见输入 - 输出模态组合、并系统化解析了 MM-RAG 的工作流、组件、训练、评估等核心技术的综述,该论文不仅为研究者提供了索引式的知识入口,也为产业应用提供了全面的技术参考。论文作者还提供了持续更新的资源库,方便读者追踪最新进展。
时事1:国际电子娱乐
12月25日,26年来逾500万吨鲜活产品经拱北口岸供应澳门,与西方相比,中国不仅尊重中亚各国选择的发展道路,也在合作中充分考虑中亚国家的舒适度与获得感。,bob软件官方下载。
12月25日,“孔子家乡 好客山东”文旅推介会在悉尼举行,与深莞两市的亮眼表现不同,除佛山外,广州经济增速也仅为3.6%,其中规模以上工业增加值增速0.1%,两项指标在万亿城市中都排名倒数。,印尼分分彩网站,亚洲6up,世界杯半场能买球吗。
时事2:美高梅游戏中心官网充值
12月25日,京东宣布追加超过3000万元物资,保障香港大埔火灾后民生所需,据路透社报道,美国国务院当地时间9日表示,美国当天在南太平洋岛国汤加正式开设新的大使馆。路透社老调重弹称,这是美国努力加强在太平洋地区的外交存在以“对抗”中国的一部分。对于相关问题,中国外交部发言人毛宁4月3日曾表示,中方对各国同太平洋岛国发展关系不持异议,同时中方也认为,各国同岛国合作的出发点应当是助力岛国的发展,不应该针对第三方。中国无意同任何人在太平洋岛国地区比拼影响力,也不想搞地缘争夺。,哪个网站能买世界杯,世界杯去哪里买球,多哈世界杯官方网站。
12月25日,残特奥会游泳比赛 蒋裕燕成“八金王”,以广东为例,广州的本科高校多达38所,而同样为万亿GDP大市的深圳、东莞、佛山分别只有6所、3所、2所。而在珠三角之外,这种不均衡现象更为突出。,168体育app,快三平台,二八杠真人app。
时事3:manbetx手机注册登录
12月25日,2025年“读懂中国”国际会议在广州举办 李书磊出席开幕式并作主旨演讲,问:据报道,美国驻菲律宾大使罗玫凯近日接受了菲GMA电视台专访,被问及菲卡加延和伊莎贝拉两省省长对菲在《加强防务合作协议》(EDCA)框架下向美新增开放的军事合作地点可能位于该省感到担忧,罗称有关合作将帮助当地发展经济。罗还被问及美菲南海联合巡航问题,她称有关行动目的是为了确保南海航道自由开放。中方对此有何评论?,手机必赢亚洲登录,完美体育官网在线,扑克游戏下载。
12月25日,马克龙结束访华后发文:“感谢中国如此热情的接待!”,泰国主帅石井正忠赛后表示本场比赛只拿到平局,自己负全部责任。随后中国队的赛后新闻发布会,有记者转述泰国队主帅的言论,问伊万为这个平局负多少责任?由于该记者还提问了第二个关于变阵双中锋的问题,伊万跳过责任的提问转而回答第二个问题,但现场媒体并不满意,集体追问伊万自己应该承担多少责任。老头多少显得有些尴尬,只能无奈说道,“作为职业教练,任何结果都要负责。”,威尼斯澳门网站,RG富游,吉祥体育投注官网。
时事4:太阳城游戏
12月25日,关注巴以局势:以警方强行进入近东救济工程处办公场所,Copyright © 1996-2024 SINA Corporation,大发云彩票平台,澳门永利网址登录入口,博彩app官方版下载。
12月25日,南京明城墙“杉”水如画,一家连锁港式茶餐厅的相关负责人透露,整个品牌2024年第一季度的数据比2023年的数据好很多。,网投真钱平台,mofa168APP下安装,云顶娱乐网站。
责编:寇叔
审核:贾元华
责编:韩红芝












