Files
task-6a02e23da6fe2e4ac16acf65/chunker.py
T
2026-05-14 16:54:05 +00:00

8 lines
365 B
Python

from langchain_text_splitter import RecursiveCharacterTextSplitter
from langchain.schema import Document
def get_chunks(content: str, title: str):
splitter = RecursiveCharacterTextSplitter(chunk_size=1000, chunk_overlap=200)
texts = splitter.split_text(content)
return [Document(page_content=t, metadata={"title": title, "content": t}) for t in texts]