npx skills add ...
npx skills add yoanbernabeu/grepai-skills --skill grepai-embeddings-ollama
Configure Ollama as embedding provider for GrepAI. Use this skill for local, private embedding generation.
npx skills add yoanbernabeu/grepai-skills --skill grepai-embeddings-ollama
This skill covers using Ollama as the embedding provider for GrepAI, enabling 100% private, local code search.
| Advantage | Description |
|---|---|
| š Privacy | Code never leaves your machine |
| š° Free | No API costs or usage limits |
| ā” Speed | No network latency |
| š Offline | Works without internet |
| š§ Control | Choose your model |
| Property | Value |
|---|---|
| Dimensions | 768 |
| Size | ~274 MB |
| Speed | Fast |
| Quality | Excellent for code |
| Language | English-optimized |
Configuration:
| Property | Value |
|---|---|
| Dimensions | 768 |
| Size | ~500 MB |
| Speed | Medium |
| Quality | Excellent |
| Language | Multilingual |
Best for codebases with non-English comments/documentation.
Configuration:
| Property | Value |
|---|---|
| Dimensions | 1024 |
| Size | ~1.2 GB |
| Speed | Slower |
| Quality | Very high |
| Language | Multilingual |
Best for large, complex codebases where accuracy is critical.
Configuration:
| Property | Value |
|---|---|
| Dimensions | 1024 |
| Size | ~670 MB |
| Speed | Medium |
| Quality | Highest |
| Language | English |
Configuration:
| Model | Dims | Size | Speed | Quality | Use Case |
|---|---|---|---|---|---|
nomic-embed-text | 768 | 274MB | ā”ā”ā” | āāā | General use |
nomic-embed-text-v2-moe | 768 | 500MB | ā”ā” | āāāā | Multilingual |
bge-m3 | 1024 | 1.2GB | ā” | āāāāā | Large codebases |
mxbai-embed-large | 1024 | 670MB | ā”ā” | āāāāā | Maximum accuracy |
Models load into RAM. Ensure sufficient memory:
| Model | RAM Required |
|---|---|
nomic-embed-text | ~500 MB |
nomic-embed-text-v2-moe | ~800 MB |
bge-m3 | ~1.5 GB |
mxbai-embed-large | ~1 GB |
Ollama automatically uses:
Check GPU usage:
By default, Ollama unloads models after 5 minutes of inactivity. Keep loaded:
Ollama app runs automatically on login.
Run Ollama on a powerful server and connect remotely:
ā Problem: Connection refused ā Solution:
ā Problem: Model not found ā Solution:
ā Problem: Slow embedding generation ā Solutions:
nomic-embed-text)ollama ps)ā Problem: Out of memory ā Solutions:
ā Problem: Embeddings differ after model update ā Solution: Re-index after model updates:
nomic-embed-text: Best balance of speed/qualitySuccessful Ollama configuration:
# .grepai/config.yaml
embedder:
provider: ollama
model: nomic-embed-text
endpoint: http://localhost:11434embedder:
provider: ollama
model: nomic-embed-text
endpoint: http://192.168.1.100:11434 # Remote Ollama serverembedder:
provider: ollama
model: nomic-embed-text
endpoint: http://localhost:11434
dimensions: 768 # Usually auto-detectedollama pull nomic-embed-textembedder:
provider: ollama
model: nomic-embed-textollama pull nomic-embed-text-v2-moeembedder:
provider: ollama
model: nomic-embed-text-v2-moeollama pull bge-m3embedder:
provider: ollama
model: bge-m3
dimensions: 1024ollama pull mxbai-embed-largeembedder:
provider: ollama
model: mxbai-embed-large
dimensions: 1024ollama ps# Keep model loaded indefinitely
curl http://localhost:11434/api/generate -d '{
"model": "nomic-embed-text",
"keep_alive": -1
}'curl http://localhost:11434/api/tagsollama listcurl http://localhost:11434/api/embeddings -d '{
"model": "nomic-embed-text",
"prompt": "function authenticate(user, password)"
}'# Enable service
sudo systemctl enable ollama
# Start service
sudo systemctl start ollama
# Check status
sudo systemctl status ollamanohup ollama serve > /dev/null 2>&1 &# Allow remote connections
OLLAMA_HOST=0.0.0.0 ollama serve# .grepai/config.yaml
embedder:
provider: ollama
model: nomic-embed-text
endpoint: http://server-ip:11434# Start Ollama
ollama serve# Pull the model
ollama pull nomic-embed-textrm .grepai/index.gob
grepai watchā
Ollama Embedding Provider Configured
Provider: Ollama
Model: nomic-embed-text
Endpoint: http://localhost:11434
Dimensions: 768 (auto-detected)
Status: Connected
Model Info:
- Size: 274 MB
- Loaded: Yes
- GPU: Apple Metal