ENTITY
TriggerBench
TriggerBench
PulseAugur coverage of TriggerBench — every cluster mentioning TriggerBench across labs, papers, and developer communities, ranked by signal.
Total · 30d
1
1 over 90d
Releases · 30d
0
0 over 90d
Papers · 30d
1
1 over 90d
TIER MIX · 90D
TOPICS
RECENT · PAGE 1/1 · 2 TOTAL
-
New benchmark TriggerBench reveals prospective memory challenges for LLMs
Researchers have introduced TriggerBench, a new benchmark designed to evaluate prospective memory (PM) in large language models (LLMs). Unlike retrospective memory (RM), which relies on explicit queries, PM assesses an …
-
New research tackles multilingual models, efficient inference, and data contamination
Recent research explores various facets of language model development and application. Google DeepMind's ATLAS project introduces new scaling laws for multilingual models, aiming to optimize training for languages beyon…