LoCoMo · recall@10 · pipeline completo
96,58%
1918/1986 preguntas · run 2026-07-29 ·0 llamadas de LLM en el ranking · ~0,84s por query en CPU
+2,1 pp sobre el líder open-source publicado (94,5% · PMB),medido en el mismo benchmark.
- 96,58% evidence recall@10 en LoCoMo. +2,1 pp vs líder open-source publicado (94,5%)
- 80,8% de exactitud binaria end-to-end en BEAM-100K (323/400 correctas en 20 conversaciones; reader GLM-5.3 Flash (Ox Alpha); juez GLM-5.2; effort=max; run 2026-08-23; ~44% más lenta que el effort estándar; el lector lo elige el cliente — los resultados varían con el modelo (lectores más fuertes pueden puntuar más). ValorBrain no vende llamadas de LLM: la capa de memoria es el producto)
- Retrieval LoCoMo: ~0,84s por query en CPU · 0 llamadas de LLM en el ranking
Tabla completa por conversación
Run canónico con 1986 preguntas en 10 conversaciones. El total de la tabla es el headline de arriba; la misma cuenta, sin promedios elegidos a dedo.
| Conversación | Documentos | Aciertos | Preguntas | R@10 |
|---|---|---|---|---|
| 26 | 19 | 191 | 199 | 96% |
| 30 | 19 | 102 | 105 | 97,1% |
| 41 | 32 | 188 | 193 | 97,4% |
| 42 | 29 | 252 | 260 | 96,9% |
| 43 | 29 | 236 | 242 | 97,5% |
| 44 | 28 | 154 | 158 | 97,5% |
| 47 | 31 | 180 | 190 | 94,7% |
| 48 | 30 | 230 | 239 | 96,2% |
| 49 | 25 | 187 | 196 | 95,4% |
| 50 | 30 | 198 | 204 | 97,1% |
| Total | 272 | 1918 | 1986 | 96,58% |