Jun Song
PulseAugur coverage of Jun Song — every cluster mentioning Jun Song across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
OpenAI 面临不当行为指控,包括数据造假和掩盖事件
OpenAI 正面临不当行为的指控,包括潜在的数据造假、知识产权盗窃以及对安全事件的掩盖。Gary Marcus 等批评者指出了涉嫌不道德行为的模式,例如向国会隐瞒信息以及误导公众关于其模型(如 Astra)的能力。还有人声称 OpenAI 在未经明确同意的情况下使用用户会话来训练其模型,引发了对“监控式抄袭”及其人工智能系统真正自主性的担忧。
-
SuperDeepseek-V4-Flash 模型发布;新研究质疑仅靠智能体扩展
一款新的开源模型 SuperDeepseek-V4-Flash 已发布,能够运行在 128-256 GB 的显存上,并取得了令人印象深刻的性能指标。该模型据称可以修复损坏的权重,并提供具有 1M 上下文窗口的改进通用智能,在双 DGX Spark 设置上速度高达 129 tokens/sec。另外,VITAGroupUT 的一项研究探讨了智能体扩展,表明仅靠模型扩展并非智能体改进的唯一驱动因素。他们的工作 StateM 在 Termi…
-
DeepSeek-V4-Pro-0813 和 Grok-4.6 在代理框架中的性能测试 · 跟踪 4 个来源
一位用户在代理框架中测试了 DeepSeek-V4-Pro-0813 和 Grok-4.6,发现它们的性能与基准测试相比略有令人失望。尽管如此,据报道,这两种模型仍然优于 Opus-5,而 Opus-5 目前受到计算资源的限制。另一位用户指出 DeepSeek 出色的推理能力,实现了高缓存率。
-
AI社区通过MiniMax蒸馏、新的ASR模型和Gemini传闻进行创新
AI社区基于MiniMax AI最近发布的权重,迅速开发了一个蒸馏LoRA模型,展示了快速的创新能力。另外,一个名为Audio8-ASR-0.1B的新开源模型已发布,支持七种语言的实时语音识别。此外,有传言称Google的Gemini 3.7 Flash已被发现,并推测Google可能因重大的计算限制和战略决策而有意推迟Gemini Pro的发布。
-
DeepSeek API 定价引发市场主导地位猜测
DeepSeek 的 API 定价引发了用户和观察者的讨论和猜测。一些人对该公司的定价策略提出了未经证实的说法,暗示其旨在通过激进的成本削减来主导市场。
-
DeepSeek 的新模型性能超越 GLM-5.2,可与 Opus 4.8 媲美
新的基准测试表明,DeepSeek 最新推出的模型拥有 2840 亿参数,其性能超越了 GLM-5.2,并可与 Opus 4.8 媲美。该新模型比其前代产品显著更小且更具成本效益,预示着人工智能创新将迎来重大飞跃。DeepSeek 正在准备很快发布其“DeepSeek-V4-Pro”模型,该模型在内部测试中已显示出更令人印象深刻的结果,尤其是在全栈开发和编码代理测试方面。
-
谷歌起诉被驳回,英伟达加大服务器生产,DeepSeek V4 美国托管宣布
谷歌起诉 SerpAI 抓取搜索结果的诉讼被驳回,因为谷歌无法证明抓取行为的发生。另外,据报道,在交付了数十万台 Grace 单机标准服务器后,英伟达正以 Vera 为目标,日产量高达 1000 个机架。此外,有用户宣布 DeepSeek V4 将在美国托管,成本远低于其他提供商,预计很快推出。
-
OpenAI 发布 GPT-5.6 并将 Codex 集成到 ChatGPT Desktop
OpenAI 发布了 GPT-5.6,引入了三个层级:Sol、Terra 和 Luna,其中 Sol 的 Ultra 模式协调多个代理以完成复杂任务。该公司还将 Codex 产品更名为 ChatGPT Desktop,并将其功能集成到一个统一的桌面应用程序中,该应用程序现在包括规划、浏览、文件管理和计算机操作的功能。这一重大转变引发了各种反响,一些人称赞新模型的能力,而另一些人则对更名以及将 Codex 集成到一个更广泛的“超级应用”…
-
MiniMax AI 发布开源 M3 模型,支持 100 万上下文
MiniMax AI 发布了 MiniMax M3,这是一款拥有 4280 亿参数和 100 万 token 上下文的新型开源模型。该模型旨在提供无审查的输出,性能可与 Gemini 3.1 Pro 相媲美。它可以在本地运行,动态 2 位 GGUF 需要 138GB RAM/VRAM,3 位则需要 165GB。