Github Trends®
9755 findingsmedian surprise 0.00933window 7 days
UNIT / TREND-MONITOR · REV 2.6
[ 7 days window ]
SOURCE: own snapshots
FINDING #2998 · UNIT ID 1213526705
SeraphimSerapis/tool-eval-bench
Tool-calling quality benchmark for LLM serving stacks. 80+ deterministic scenarios testing multi-turn orchestration, safety boundaries, and structured output. Supports vLLM, SGLang, and llama.cpp.
[ PYTHON ][ GITHUB ↗ ]
SURPRISE SCORE
0.00

Score Breakdown

SURPRISE0.0117
ENGAGEMENT0.45
FRESHNESS1.00
SCORE = SURPRISE × ENGAGEMENT^0.7 × FRESHNESS × VISIBILITY × CONFIDENCE
SURPRISE = WINDOW STARS / DAYS / (AUDIENCE + FLOOR)
6% OF STARS IN ARCHIVE

Growth Telemetry

VELOCITY /D
2.71
ACCEL
+0.68
RETENTION
0.0%
PEAK 2026-08-30 · FORK-RETENTION 0.0% · 19 STARS / WINDOW

Author Audience

AUDIENCE
192
FOLLOWERS
142
OWNER ★
503

Engagement Signals

FORKS
42
ISSUE AUTH
0
PR AUTH
0
UNIQUE STARGAZERS 19 / 19 (DIVERSITY 1.00)

Why This Is A Finding

SeraphimSerapis/tool-eval-bench собрал 19 звёзд за окно, тогда как у автора всего 142 подписчиков — эффективная аудитория ≈ 192. Это даёт surprise-индекс 0.0117 (звёзды относительно охвата автора, а не в абсолюте). Удержание форков 0.0% и 0 внешних контрибьюторов отделяют реальный инструмент от разовой вспышки. Акселерация положительная — рост ещё не выдохся.

METRICS IN CONTEXT

MEDIAN ACROSS ALL 9755 FINDINGS · Δ vs MEDIAN · PERCENTILE = SHARE RANKED BELOW
METRICVALUEMEDIANΔ MEDPERCENTILE
SCORE0.010.00+0.00ABOVE 69%
VELOCITY2.713.71-1.00ABOVE 36%
RETENTION0.0%37.5%-37.5 PPABOVE 0%
FORKS4290-48ABOVE 32%
SURPRISE0.010.01+0.00ABOVE 56%