PulseAugur
EN
LIVE 11:12:16
Deutsch(DE) RT @henryqin1997: Ist das Skalieren von Modellen die einzige Quelle für die Verbesserung von Agenten? Wir @henryqin1997 @YaxinLu1997 @VITAGroupUT @VictorKaiWang

SuperDeepseek-V4-Flash model released; new research questions agent scaling alone

A new open-source model, SuperDeepseek-V4-Flash, has been released, capable of running on 128-256 GB of VRAM and achieving impressive performance metrics. This model reportedly repairs corrupted weights and offers improved general intelligence with a 1M context window, reaching speeds of up to 129 tokens/sec on a dual-DGX Spark setup. Separately, research from VITAGroupUT explores agent scaling, suggesting that model scaling alone is not the sole driver of agent improvement. Their work, StateM, achieves high accuracy on the Terminal-Bench 2.1, even outperforming some frontier models when combined with agent actions for better workflow control. AI

IMPACT Highlights advancements in open-source model capabilities and challenges conventional approaches to AI agent development.

RANK_REASON The cluster includes both a model release and a research paper discussing agent scaling.

Read on Mastodon — fosstodon.org →

AI-generated summary · Google Gemini · from 2 sources. How we write summaries →

SuperDeepseek-V4-Flash model released; new research questions agent scaling alone

COVERAGE [2]

  1. Mastodon — fosstodon.org TIER_1 Deutsch(DE) · [email protected] ·

    RT @jun_song: Introducing SuperDeepseek-V4-Flash🚀 The strongest model you can run on 128-256GB VRAM/unified RAM. Abliterated for the Fr

    RT @jun_song: Wir stellen vor: SuperDeepseek-V4-Flash🚀 Das stärkste Modell, das du auf 128–256 GB VRAM/unifiziertem RAM ausführen kannst. Abliteriert für die Freiheit Defekte Gewichte aus der Abliteration mit einem Multi-AI-Agent-Schwarm repariert. Verbesserte allgemeine Intellig…

  2. Mastodon — fosstodon.org TIER_1 Deutsch(DE) · [email protected] ·

    RT @henryqin1997: Is scaling models the only source for improving agents? We @henryqin1997 @YaxinLu1997 @VITAGroupUT @VictorKaiWang

    RT @henryqin1997: Ist das Skalieren von Modellen die einzige Quelle für die Verbesserung von Agenten? Wir @henryqin1997 @YaxinLu1997 @VITAGroupUT @VictorKaiWang1 freuen uns, unsere Arbeit vorzustellen: Durch Harness Scaling erreichen wir 95,3 % Raw Accuracy bzw. eine $15 Frontier…