Orquestração de memória open source para fluxos de trabalho de programação guiados por contexto.
🌐 Português · English · Español
Grafo neural com conteúdo de contexto real — cada nó é um arquivo de contexto, cada família de cor é uma área de memória.
O Codex Memory é um serviço de memória local que lê arquivos de contexto em Markdown, consolida memória operacional de longo prazo com um motor selecionável (ollama ou algorithm determinístico), e expõe uma interface visual para inspecionar relações entre contextos.
O projeto roda em três modos:
- Aplicativo desktop com Electron
- Modo GUI via navegador
- Modo daemon para atualização periódica da memória
Arquivos de contexto são fáceis de escrever mas difíceis de manter sincronizados ao longo do tempo. O Codex Memory resolve isso:
- Consolidando múltiplos arquivos
context_*.mdem um único arquivo operacional - Mantendo a memória atualizada via daemon ou sincronização manual
- Provendo um grafo estilo neural para inspecionar ligações entre nós de contexto
- Expondo APIs locais para automação e integração
- Motor de memória selecionável por sessão:
ollamaoualgorithmdeterminístico - Atualização automática ou manual do
AGENT_MEMORY.mdcom cabeçalho estável e sem linha de timestamp - Inicialização rápida da GUI sem bloquear na consolidação
- CRUD de contextos pela GUI e API
- Visualização do grafo de contextos com metadados ao hover
- Snapshot do grafo de neurônios persistido para carregamento mais rápido
- Interface multilíngue com detecção automática de locale
- Ícone desktop e branding dos assets do projeto
- Decisões canônicas com rastreamento de contradições e rastreabilidade de fontes
- Snapshots do
AGENT_MEMORY.mdcom rolagem (últimos 10)
context_1.md é o contexto fundamento do sistema de memória e deve ser escrito e mantido por um humano.
Por que isso importa:
- Ele ancora regras de longo prazo e decisões não-negociáveis do projeto.
- O motor de grafo o trata como neurônio fundamento e o mantém central na visualização.
- Outros contextos devem referenciá-lo para que a ligação algorítmica preserve uma espinha dorsal de memória consistente.
- Manter este arquivo curado por humanos reduz desvios e evita perda acidental da intenção central do projeto.
| Variável | Padrão | Descrição |
|---|---|---|
OLLAMA_MODEL |
qwen2.5:3b |
Modelo Ollama usado |
MEMORY_ENGINE |
ollama |
Motor de memória (ollama ou algorithm) |
OLLAMA_HOST |
http://127.0.0.1:11434 |
Endpoint do Ollama |
OLLAMA_TIMEOUT_SEC |
300 |
Timeout das chamadas ao Ollama |
OLLAMA_CONTEXT_MAX_CHARS_PER_FILE |
3500 |
Limite de caracteres por arquivo de contexto |
OLLAMA_CONTEXT_MAX_TOTAL_CHARS |
22000 |
Limite total de caracteres enviados |
DAEMON_REFRESH_SEC |
300 |
Intervalo de refresh do daemon |
GUI_HOST |
127.0.0.1 |
Host da GUI |
GUI_PORT |
4173 |
Porta da GUI |
Quando MEMORY_ENGINE=algorithm, o Ollama não é carregado na sessão.
Veja o guia completo em INSTALL.md.
Para detalhes de arquitetura e implementação, leia TECHNICAL.md.
| Método | Rota | Descrição |
|---|---|---|
GET |
/api/status |
Status do daemon e engine |
POST |
/api/sync |
Sincronização manual |
POST |
/api/memory/force |
Força consolidação |
POST |
/api/daemon/start |
Inicia daemon |
POST |
/api/daemon/stop |
Para daemon |
POST |
/api/daemon/restart |
Reinicia daemon |
GET |
/api/contexts |
Lista contextos |
POST |
/api/contexts |
Cria contexto |
GET |
/api/contexts/:name |
Lê contexto |
PUT |
/api/contexts/:name |
Atualiza contexto |
DELETE |
/api/contexts/:name |
Remove contexto |
GET |
/api/memory |
Lê memória consolidada |
GET |
/api/graph |
Grafo de neurônios |
npm run test:memory