strategy-scope/si_et_al-ideation-gpt41mini-20260414_221654-evaluation
si_et_al-ideation-gpt41mini-20260414_221654-evaluation Aggregate per-topic metrics (+ overall row where topic = __overall__). Parent: si_et_al-ideation-gpt41mini-20260414_221654 Run Parameters model: gpt-4.1-mini-2025-04-14 judge_model: gpt-4o-mini-2024-07-18 strategy: none n_ideas_per_run: 5 n_runs: 3 n_topics: 3 rag: False Columns topic / n_ideas mean_{novelty,excitement,feasibility,effectiveness,overall}: LLM-judge means… See the full description on the dataset page: https://huggingface.co/datasets/strategy-scope/si_et_al-ideation-gpt41mini-20260414_221654-evaluation.
06
sietal-ideation-gpt41mini-20260414_221654-evaluation
Aggregate per-topic metrics (+ overall row where topic = __overall__). Parent: si_et_al-ideation-gpt41mini-20260414_221654
Run Parameters
- model: gpt-4.1-mini-2025-04-14
- judge_model: gpt-4o-mini-2024-07-18
- strategy: none
- n_ideas_per_run: 5
- n_runs: 3
- n_topics: 3
- rag: False
Columns
- topic / n_ideas
- mean_{novelty,excitement,feasibility,effectiveness,overall}: LLM-judge means
- diversity_cosine_{pairwise,nn} / diversity_jaccard_{pairwise,nn}: 1 - similarity
