Singapore AI Safety Institute
PulseAugur coverage of Singapore AI Safety Institute — every cluster mentioning Singapore AI Safety Institute across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
Google DeepMind 试点双盲AI基准测试以增强信任
Google DeepMind 正在试点一种新颖的AI基准测试方法,旨在增强信任并防止篡改。该方法通过 Confidential Space 使用加密保护,确保谷歌无法查看测试问题,评估者也无法访问模型权重。该倡议与新加坡AI安全研究所合作进行,使用了 Gemini Flash Lite 模型,并可能为安全可靠的AI评估建立新的行业标准。
-
OpenAI 发布 GPT-5.6,扩展 ChatGPT 广告业务,并探索企业 AI 采用 · 跟踪 10 个来源
OpenAI 发布了 GPT-5.6,这是一个新的前沿智能模型,强调每 token 智能的提升、每美元性能的改进以及复杂任务的增强的按需能力。此次发布遵循了 OpenAI 扩大 AI 访问的更广泛战略,ChatGPT 广告业务达到 10 亿美元的年化收入运行率及其全球扩张证明了这一点。该公司还在探索企业如何整合代理式 AI,重点关注组织设计以跟上 AI 进步的步伐,并通过新的记分卡衡量 AI 投资回报率。
-
新研究解决大语言模型的事实准确性、架构推断和专业化评估问题
研究人员正在开发新方法来提高大语言模型(LLM)的准确性和可靠性。Google Research 推出了 SLED(Self Logits Evolution Decoding)技术,该技术利用 LLM 的所有层来增强事实准确性,而无需额外的微调或外部数据。同时,研究也在探索如何通过限制性 API 访问来推断 LLM 的架构属性,并创建新的基准来评估 LLM 在金融服务和编译器问题解决等专业领域的表现。此外,研究还在调查 LLM 集成…