自拍偷在线精品自拍偷,亚洲欧美中文日韩v在线观看不卡

<legend id="ainns"><track id="ainns"><dfn id="ainns"></dfn></track></legend>

<blockquote id="ainns"><i id="ainns"></i></blockquote>

51CTO首頁(yè)

AI.x社區(qū)

軟考社區(qū)

免費(fèi)課

企業(yè)培訓(xùn)

鴻蒙開(kāi)發(fā)者社區(qū)

WOT技術(shù)大會(huì)

公眾號(hào)矩陣

移動(dòng)端

視頻課免費(fèi)課排行榜短視頻直播課軟考學(xué)堂

全部課程軟考華為認(rèn)證廠(chǎng)商認(rèn)證 IT技術(shù)PMP項(xiàng)目管理免費(fèi)題庫(kù)

在線(xiàn)學(xué)習(xí)

文章資源問(wèn)答課堂專(zhuān)欄直播

51CTO

鴻蒙開(kāi)發(fā)者社區(qū)

51CTO技術(shù)棧

51CTO官微

51CTO學(xué)堂

51CTO博客

CTO訓(xùn)練營(yíng)

鴻蒙開(kāi)發(fā)者社區(qū)訂閱號(hào)

51CTO軟考

51CTO學(xué)堂APP

51CTO學(xué)堂企業(yè)版APP

鴻蒙開(kāi)發(fā)者社區(qū)視頻號(hào)

51CTO軟考題庫(kù)

AI.x社區(qū)

登錄/注冊(cè)
51CTO

中國(guó)優(yōu)質(zhì)的IT技術(shù)網(wǎng)站

51CTO博客

專(zhuān)業(yè)IT技術(shù)創(chuàng)作平臺(tái)

51CTO學(xué)堂

IT職業(yè)在線(xiàn)教育平臺(tái)

RAG再進(jìn)化？基于長(zhǎng)期記憶的檢索增強(qiáng)生成新范式-MemoRAG 原創(chuàng)

大模型自然語(yǔ)言處理

發(fā)布于 2024-11-28 16:37

瀏覽

0收藏

前言

RAG現(xiàn)在工作很多，進(jìn)化的也很快，再來(lái)看看一個(gè)新的RAG工作-MemoRAG。

文章提出，RAG在減少大模型對(duì)于垂類(lèi)知識(shí)的問(wèn)答幻覺(jué)上取得了不錯(cuò)的效果，也成為私域知識(shí)問(wèn)答的一種范式。然而，傳統(tǒng)RAG系統(tǒng)主要適用于明確信息需求的問(wèn)答任務(wù)，但在處理涉及模糊信息需求或非結(jié)構(gòu)化知識(shí)的復(fù)雜任務(wù)時(shí)表現(xiàn)不佳。因?yàn)?，現(xiàn)實(shí)世界中的許多問(wèn)題信息需求是模糊的，外部知識(shí)是非結(jié)構(gòu)化的，例如理解書(shū)籍中主要角色之間的相互關(guān)系。

因此，研究難點(diǎn)在于：

如何有效處理模糊的信息需求
如何從非結(jié)構(gòu)化知識(shí)中提取有用信息
如何在長(zhǎng)文本上下文中進(jìn)行有效的信息檢索和生成

本文介紹的MemoRAG，一種基于長(zhǎng)期記憶的檢索增強(qiáng)生成新范式。

方法

RAG再進(jìn)化？基于長(zhǎng)期記憶的檢索增強(qiáng)生成新范式-MemoRAG-AI.x社區(qū)

MemoRAG

傳統(tǒng)RAG

RAG再進(jìn)化？基于長(zhǎng)期記憶的檢索增強(qiáng)生成新范式-MemoRAG-AI.x社區(qū)

MemoRAG：MemoRAG提出了一個(gè)雙系統(tǒng)架構(gòu)，采用了一個(gè)輕量級(jí)但長(zhǎng)上下文的LLM來(lái)形成數(shù)據(jù)庫(kù)的全局記憶，并在任務(wù)呈現(xiàn)時(shí)生成草稿答案，提示檢索工具在數(shù)據(jù)庫(kù)中定位有用信息。另一方面，它利用一個(gè)能力較強(qiáng)的LLM，根據(jù)檢索到的信息生成最終答案。
MemoRAG的核心是引入了一個(gè)記憶模塊：

RAG再進(jìn)化？基于長(zhǎng)期記憶的檢索增強(qiáng)生成新范式-MemoRAG-AI.x社區(qū)

RAG再進(jìn)化？基于長(zhǎng)期記憶的檢索增強(qiáng)生成新范式-MemoRAG-AI.x社區(qū)

記憶模塊設(shè)計(jì)

1.輸入
輸入序列 X 包含 n 個(gè)標(biāo)記，表示為X₁，...，X_n。

2.標(biāo)注注意力機(jī)制

RAG再進(jìn)化？基于長(zhǎng)期記憶的檢索增強(qiáng)生成新范式-MemoRAG-AI.x社區(qū)

RAG再進(jìn)化？基于長(zhǎng)期記憶的檢索增強(qiáng)生成新范式-MemoRAG-AI.x社區(qū)

4.記憶模塊訓(xùn)練：

訓(xùn)練過(guò)程
記憶模塊的訓(xùn)練分為兩個(gè)階段：

預(yù)訓(xùn)練：使用來(lái)自RedPajama數(shù)據(jù)集的隨機(jī)抽樣長(zhǎng)上下文對(duì)模型進(jìn)行預(yù)訓(xùn)練，使記憶模塊能夠從原始上下文中學(xué)習(xí)如何形成記憶。

指令微調(diào)（SFT）：使用特定任務(wù)的SFT數(shù)據(jù)，使MemoRAG能夠基于形成的記憶生成特定任務(wù)的線(xiàn)索。

訓(xùn)練目標(biāo)

RAG再進(jìn)化？基于長(zhǎng)期記憶的檢索增強(qiáng)生成新范式-MemoRAG-AI.x社區(qū)

通過(guò)這種設(shè)計(jì)，記憶模塊能夠有效地將大量原始上下文壓縮成少量的記憶標(biāo)記，同時(shí)保留關(guān)鍵的語(yǔ)義信息，從而在處理長(zhǎng)上下文和高層次查詢(xún)時(shí)提供顯著的優(yōu)勢(shì)。

基本使用

from memorag import MemoRAG

# Initialize MemoRAG pipeline
pipe = MemoRAG(
    mem_model_name_or_path="TommyChien/memorag-mistral-7b-inst",
    ret_model_name_or_path="BAAI/bge-m3", 
    gen_model_name_or_path="mistralai/Mistral-7B-Instruct-v0.2", # Optional: if not specify, use memery model as the generator
    cache_dir="path_to_model_cache",  # Optional: specify local model cache directory
    access_token="hugging_face_access_token",  # Optional: Hugging Face access token
    beacon_ratio=4
)

context = open("examples/harry_potter.txt").read()
query = "How many times is the Chamber of Secrets opened in the book?"

# Memorize the context and save to cache
pipe.memorize(context, save_dir="cache/harry_potter/", print_stats=True)

# Generate response using the memorized context
res = pipe(cnotallow=context, query=query, task_type="memorag", max_new_tokens=256)
print(f"MemoRAG generated answer: \n{res}")

運(yùn)行上述代碼時(shí)，編碼后的鍵值 (KV) 緩存、Faiss 索引和分塊段落都存儲(chǔ)在指定的中save_dir。之后，如果再次使用相同的上下文，則可以快速?gòu)拇疟P(pán)加載數(shù)據(jù)：

pipe.load("cache/harry_potter/", print_stats=True)

摘要任務(wù)

res = pipe(cnotallow=context, task_type="summarize", max_new_tokens=512)
print(f"MemoRAG summary of the full book:\n {res}")

實(shí)驗(yàn)

RAG再進(jìn)化？基于長(zhǎng)期記憶的檢索增強(qiáng)生成新范式-MemoRAG-AI.x社區(qū)

參考文獻(xiàn)

paper：MEMORAG: MOVING TOWARDS NEXT-GEN RAG VIA MEMORY-INSPIRED KNOWLEDGE DISCOVERY，https://arxiv.org/pdf/2409.05591v2
code：https://github.com/qhjqhj00/MemoRAG

本文轉(zhuǎn)載自公眾號(hào)大模型自然語(yǔ)言處理作者：余俊暉

原文鏈接：??https://mp.weixin.qq.com/s/f5GiIcjtEuxtOitPgfsjcQ??

?著作權(quán)歸作者所有，如需轉(zhuǎn)載，請(qǐng)注明出處，否則將追究法律責(zé)任

標(biāo)簽

已于2024-11-28 18:47:29修改

贊

收藏

回復(fù)

舉報(bào)

回復(fù)

相關(guān)推薦

通過(guò)檢索增強(qiáng)生成(RAG) 增強(qiáng)LLM的實(shí)戰(zhàn)演練

51CTO內(nèi)容精選 ? 3217瀏覽 ? 0回復(fù)
萬(wàn)文長(zhǎng)文搞定檢索增強(qiáng)生成(RAG)技術(shù)——13篇熱門(mén)RAG文章解讀

angel ? 1.1w瀏覽 ? 0回復(fù)
面向大語(yǔ)言模型的檢索增強(qiáng)生成(RAG)技術(shù)：綜述

angel ? 4701瀏覽 ? 0回復(fù)
一起聊聊圖檢索增強(qiáng)生成

sbf_2000 ? 2583瀏覽 ? 0回復(fù)
RAG新范式MemLong：用于長(zhǎng)文本生成的記憶增強(qiáng)檢索

PaperAgent ? 2548瀏覽 ? 0回復(fù)
15種先進(jìn)的檢索增強(qiáng)生成（RAG）技術(shù)

玄姐聊AGI ? 2414瀏覽 ? 0回復(fù)
RAG高級(jí)優(yōu)化：基于問(wèn)題生成的文檔檢索增強(qiáng)

恰似驚鴻 ? 2713瀏覽 ? 0回復(fù)
15種先進(jìn)的檢索增強(qiáng)生成（RAG）技術(shù)

Halo咯咯 ? 1840瀏覽 ? 0回復(fù)
多模態(tài)RAG-VisRAG：基于視覺(jué)的檢索增強(qiáng)生成在多模態(tài)文檔上的應(yīng)用

大模型自然語(yǔ)言處理 ? 2419瀏覽 ? 0回復(fù)
再談大模型檢索增強(qiáng)生成——RAG

AI探索時(shí)代 ? 1838瀏覽 ? 0回復(fù)
提升RAG性能的全攻略：優(yōu)化檢索增強(qiáng)生成系統(tǒng)的策略大揭秘

Halo咯咯 ? 5195瀏覽 ? 0回復(fù)
mR^2AG：基于知識(shí)的多模態(tài)檢索-反思增強(qiáng)生成方法淺嘗

大模型自然語(yǔ)言處理 ? 1841瀏覽 ? 0回復(fù)
大模型超長(zhǎng)窗口上下文與檢索增強(qiáng)生成——RAG

AI探索時(shí)代 ? 2281瀏覽 ? 0回復(fù)
RAG檢索增強(qiáng)生成和大模型微調(diào)的抉擇

AI探索時(shí)代 ? 1972瀏覽 ? 0回復(fù)
九種不同類(lèi)型的檢索增強(qiáng)生成 (RAG)

Halo咯咯 ? 2373瀏覽 ? 0回復(fù)
繞過(guò) RAG 實(shí)時(shí)檢索瓶頸，緩存增強(qiáng)生成（CAG）如何助力性能突破？

Baihai_IDP ? 1681瀏覽 ? 0回復(fù)
什么是檢索增強(qiáng)生成 (RAG)？

Halo咯咯 ? 1611瀏覽 ? 0回復(fù)
18種RAG技術(shù)大比拼：誰(shuí)才是檢索增強(qiáng)生成的最佳選擇？

Halo咯咯 ? 1473瀏覽 ? 0回復(fù)
NodeRAG：以圖結(jié)構(gòu)革新檢索增強(qiáng)生成

PyTorch研習(xí)社 ? 242瀏覽 ? 0回復(fù)

大模型自然語(yǔ)言處理

這個(gè)用戶(hù)很懶，還沒(méi)有個(gè)人簡(jiǎn)介

帖子

聲望

粉絲

關(guān)注

最近發(fā)布

Kimi-VL開(kāi)源多模態(tài)大模型結(jié)構(gòu)、訓(xùn)練方法、訓(xùn)練數(shù)據(jù)淺析 2025-04-16 07:08:19發(fā)布
十大PDF解析工具在不同文檔類(lèi)別中的比較研究 2025-04-07 06:31:37發(fā)布

熱門(mén)推薦

大半精銳盡出！o1下線(xiàn)！滿(mǎn)血o3之后，模型本身就是Manus，最大賣(mài)點(diǎn)：替代人干真活！ 1回復(fù)

王炸！MCP 架構(gòu)設(shè)計(jì)深度剖析 & 使用 Spring AI + MCP 四步教你實(shí)現(xiàn) Agent 智能體開(kāi)發(fā) 0回復(fù)

Dify從入門(mén)到高階系列二：手把手教學(xué)！超詳細(xì)的Dify知識(shí)庫(kù)配置全攻略 0回復(fù)

Crawl4AI：GitHub榜首40K星標(biāo)！LLM專(zhuān)屬極速開(kāi)源爬蟲(chóng)神器 0回復(fù)

只需5分鐘，教你用Python搭建MCP Server 0回復(fù)

上一篇： HiQA：一種用于多文檔問(wèn)答的層次化上下文增強(qiáng)RAG

下一篇：混合RAG系統(tǒng)，提升復(fù)雜推理任務(wù)表現(xiàn)

社區(qū)精華內(nèi)容

目錄