Files
2026-05-15 08:39:58 +00:00

13 lines
357 B
Python

from langchain_text_splitter import RecursiveCharacterTextSplitter
def get_chunks(content, title):
splitter = RecursiveCharacterTextSplitter(chunk_size=1000, chunk_overlap=200)
texts = splitter.split_text(content)
return [
{
"page_content": t,
"metadata": {"title": title}
}
for t in texts
]