harnex-ai
v0.1.1
Published
Harnex AI — plateforme locale d'orchestration LLM multi-modèles (Ollama). Chat streaming, agent de coding, tools, RAG.
Maintainers
Readme
Harnex AI
Plateforme locale d'orchestration LLM multi-modèles pour Ollama. Chat streaming, agent de coding avec tools (fichiers, shell, web search), RAG, MCP, automations — le tout embarqué dans un exécutable autonome Windows.
Installation
npm i -g harnex-aiPrérequis : Windows x64, Ollama en cours d'exécution (http://localhost:11434). Node ≥ 18 pour le launcher.
Utilisation
harnex # serveur sur http://localhost:8000
harnex --port 8080 # port personnalisé
harnex --host 0.0.0.0 # écoute réseau (LAN)L'app web et l'API sont servies sur le même port : ouvrez http://localhost:8000.
Les données (data/, workspace/) sont créées à côté de l'exécutable et persistent entre les runs.
Fonctionnalités
- Chat multi-modèles : streaming SSE, rôles (primary/reasoning/fast/fallback), fallback automatique avec récupération d'erreurs contexte/VRAM
- Agent de coding : boucle d'outils (lecture/écriture/édition de fichiers, shell, web search), modes de permission (Normal/Plan/Auto), sous-agents
- Multi-agents : presets nommés avec modèle et permissions propres
- MCP : connexion à des serveurs MCP externes (stdio), outils découverts injectés dans l'agent
- Automations : prompts agentiques planifiés (cron)
- Plugins : catalog marketplace, plugins déclaratifs tools + skills
- RAG : embeddings locaux, recherche dans les conversations et le workspace
- Local-only : aucune télémétrie, tout reste sur la machine
Modèles
Harnex détecte automatiquement les modèles Ollama installés et remappe les rôles (primary, reasoning, fast, coding, fallback) sur ce qui est présent. Cible matérielle indicative : 8 Go VRAM + 32 Go RAM (OLLAMA_MAX_LOADED_MODELS=1).
Licence
MIT
