Global Relationship ranking
Rank 1Replika81.7C/O ScoreIllustrative preview: in this staging dataset Replika reads strongest on conversation quality and weakest on character fidelity under methodology v0.1.
Illustrative record: character fidelity scored 68/100 in the staging scenario set.
- conversation quality 85/1002026-08-15
- character fidelity 68/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 2Lovey Dovey81.5C/O Score
Illustrative preview: in this staging dataset Lovey Dovey reads strongest on emotional response and weakest on character fidelity under methodology v0.1.
Illustrative record: character fidelity scored 62/100 in the staging scenario set.
- emotional response 87/1002026-08-15
- character fidelity 62/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 3Character.AI80.2C/O ScoreIllustrative preview: in this staging dataset Character.AI reads strongest on character fidelity and weakest on memory controls under methodology v0.1.
Illustrative record: memory controls scored 68/100 in the staging scenario set.
- character fidelity 89/1002026-08-15
- memory controls 68/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 4Nomi79.5C/O ScoreIllustrative preview: in this staging dataset Nomi reads strongest on delayed recall and weakest on character fidelity under methodology v0.1.
Illustrative record: character fidelity scored 74/100 in the staging scenario set.
- delayed recall 94/1002026-08-15
- character fidelity 74/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 5Kindroid78.5C/O Score
Illustrative preview: in this staging dataset Kindroid reads strongest on delayed recall and weakest on character fidelity under methodology v0.1.
Illustrative record: character fidelity scored 71/100 in the staging scenario set.
- delayed recall 93/1002026-08-15
- character fidelity 71/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 6boyfrnd76.2C/O Score
Illustrative preview: in this staging dataset boyfrnd reads strongest on emotional response and weakest on character fidelity under methodology v0.1.
Illustrative record: character fidelity scored 62/100 in the staging scenario set.
- emotional response 81/1002026-08-15
- character fidelity 62/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 7Zeta75.2C/O ScoreIllustrative preview: in this staging dataset Zeta reads strongest on character fidelity and weakest on delayed recall under methodology v0.1.
Illustrative record: delayed recall scored 65/100 in the staging scenario set.
- character fidelity 87/1002026-08-15
- delayed recall 65/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 8Talkie73.7C/O ScoreIllustrative preview: in this staging dataset Talkie reads strongest on character fidelity and weakest on memory controls under methodology v0.1.
Illustrative record: memory controls scored 67/100 in the staging scenario set.
- character fidelity 78/1002026-08-15
- memory controls 67/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 9Crack71.1C/O Score
Illustrative preview: in this staging dataset Crack reads strongest on narrative continuity and weakest on delayed recall under methodology v0.1.
Illustrative record: delayed recall scored 64/100 in the staging scenario set.
- narrative continuity 81/1002026-08-15
- delayed recall 64/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 10wishwell70.3C/O ScoreIllustrative preview: in this staging dataset wishwell reads strongest on character fidelity and weakest on delayed recall under methodology v0.1.
Illustrative record: delayed recall scored 61/100 in the staging scenario set.
- character fidelity 80/1002026-08-15
- delayed recall 61/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 11Paradot69C/O ScoreIllustrative preview: in this staging dataset Paradot reads strongest on memory controls and weakest on character fidelity under methodology v0.1.
Illustrative record: character fidelity scored 62/100 in the staging scenario set.
- memory controls 83/1002026-08-15
- character fidelity 62/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 12bada67.5C/O ScoreIllustrative preview: in this staging dataset bada reads strongest on local-language performance and weakest on memory controls under methodology v0.1.
Illustrative record: memory controls scored 56/100 in the staging scenario set.
- local-language performance 75/1002026-08-15
- memory controls 56/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 13PolyBuzz67.5C/O ScoreIllustrative preview: in this staging dataset PolyBuzz reads strongest on character fidelity and weakest on memory controls under methodology v0.1.
Illustrative record: memory controls scored 61/100 in the staging scenario set.
- character fidelity 75/1002026-08-15
- memory controls 61/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 14Janitor AI66.2C/O ScoreIllustrative preview: in this staging dataset Janitor AI reads strongest on narrative continuity and weakest on delayed recall under methodology v0.1.
Illustrative record: delayed recall scored 56/100 in the staging scenario set.
- narrative continuity 77/1002026-08-15
- delayed recall 56/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 15Anima66.1C/O ScoreIllustrative preview: in this staging dataset Anima reads strongest on conversation quality and weakest on narrative initiative under methodology v0.1.
Illustrative record: narrative initiative scored 54/100 in the staging scenario set.
- conversation quality 72/1002026-08-15
- narrative initiative 54/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 16dolcall65.7C/O Score
Illustrative preview: in this staging dataset dolcall reads strongest on conversation quality and weakest on narrative continuity under methodology v0.1.
Illustrative record: narrative continuity scored 55/100 in the staging scenario set.
- conversation quality 74/1002026-08-15
- narrative continuity 55/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 17Cotomo65.3C/O ScoreIllustrative preview: in this staging dataset Cotomo reads strongest on local-language performance and weakest on delayed recall under methodology v0.1.
Illustrative record: delayed recall scored 60/100 in the staging scenario set.
- local-language performance 71/1002026-08-15
- delayed recall 60/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 18sikiji65.2C/O ScoreIllustrative preview: in this staging dataset sikiji reads strongest on character fidelity and weakest on conversation quality under methodology v0.1.
Illustrative record: conversation quality scored 62/100 in the staging scenario set.
- character fidelity 75/1002026-08-15
- conversation quality 62/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 19befall62.8C/O ScoreIllustrative preview: in this staging dataset befall reads strongest on character fidelity and weakest on session continuity under methodology v0.1.
Illustrative record: session continuity scored 59/100 in the staging scenario set.
- character fidelity 76/1002026-08-15
- session continuity 59/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 20Chai62.6C/O ScoreIllustrative preview: in this staging dataset Chai reads strongest on narrative initiative and weakest on delayed recall under methodology v0.1.
Illustrative record: delayed recall scored 53/100 in the staging scenario set.
- narrative initiative 74/1002026-08-15
- delayed recall 53/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 21EVA AI62.4C/O ScoreIllustrative preview: in this staging dataset EVA AI reads strongest on emotional response and weakest on narrative initiative under methodology v0.1.
Illustrative record: narrative initiative scored 50/100 in the staging scenario set.
- emotional response 68/1002026-08-15
- narrative initiative 50/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 22morewhere61.4C/O ScoreIllustrative preview: in this staging dataset morewhere reads strongest on relationship continuity and weakest on character fidelity under methodology v0.1.
Illustrative record: character fidelity scored 54/100 in the staging scenario set.
- relationship continuity 70/1002026-08-15
- character fidelity 54/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15
Rank 23Loverse60.3C/O ScoreIllustrative preview: in this staging dataset Loverse reads strongest on relationship continuity and weakest on character fidelity under methodology v0.1.
Illustrative record: character fidelity scored 50/100 in the staging scenario set.
- relationship continuity 69/1002026-08-15
- character fidelity 50/1002026-08-15
- 14-day scenario set, paid-standard tier2026-08-15