Skip to main content
SemanticChunking wraps Chonkie’s semantic chunker and groups sentences using embedding similarity. See Chonkie Semantic Chunker.
1

Create a Python file

Save one of these variants as semantic_chunking.py:
2

Set up your virtual environment

3

Install dependencies

4

Export your OpenAI API key

Set OpenAI Key

Set your OPENAI_API_KEY as an environment variable. You can get one from OpenAI.
5

Run PgVector

6

Run the script

The example sets split_on_pages=False so PDFReader combines the pages before applying SemanticChunking. Keep the default value of True to chunk each page independently.

Choose an Embedder

The embedder parameter accepts an Agno Embedder, a Chonkie BaseEmbeddings instance, or a string model identifier resolved by Chonkie. See Chonkie Embeddings.

Semantic Chunking Params

Developer Resources