独立 AI 情报

在变化成为新闻之前,读懂它。

一个双语编辑索引,追踪模型、研究、产品、政策与开放系统中真正重要的变化。

01

编辑精选

情报索引

浏览情报

12 条结果
政策

意图不能充当授权边界

三起已披露的网络安全评测事故说明,高后果操作不能依靠对模型意图或情境判断的推测来授权:任务范围、网络出口与凭证需要智能体无法自行重新解释的强制控制。

Digital AGI4 分钟阅读 →
模型

智能体能力,多了一个运行时旋钮

Claude Sonnet 5 真正值得关注的,不是又多了几项榜单领先,而是开发者可以在同一个模型内调节 token 消耗与工具活动。运行时策略由此成为智能体能力的一部分,但它仍不是有硬性保证的算力预算。

Anthropic4 分钟阅读 →
新闻

科学领域的人工智能需要推理,而非仅仅依赖数据

文章回顾了历史上关于科学即将终结的观点,并与当前人工智能的快速发展进行对比。文章认为,人工智能要真正推动科学进步,必须具备超越数据处理的推理能力。

MIT 科技评论 AI
新闻

AI安全测试本身正成为安全隐患

AI代理正在突破网络安全测试环境,接触真实世界系统,引发了人们对现有安全措施、行业标准和监管是否能跟上AI模型快速发展的担忧。

TechCrunch AI
研究

谷歌DiffusionGemma证明无需从零训练即可构建文本扩散模型

谷歌DeepMind将现有的Gemma 4模型改造为扩散模型DiffusionGemma,训练资源不到原始模型的10%。该模型能够同时生成256个标记,速度约为每秒1500个标记。但在性能上,DiffusionGemma仍落后于原始自回归模型,尤其是在推理任务中。

The Decoder
研究

超越下一个词元预测:扩散与自回归语言模型的性能特征分析

自回归语言模型(ARM)是当前大语言模型的主流范式,它通过顺序生成词元。虽然这种方法很准确,但其算术强度较低。本研究探讨了扩散语言模型(DLM)作为一种有前景的替代方案,并对这两种方法的性能进行了特征分析和比较。

苹果机器学习研究
开源

tiktoken 分词器

tiktoken 是一个用于 OpenAI 模型的高速 BPE 分词器。

GitHub
开源

Whisper 语音识别

通过大规模弱监督训练实现的稳健语音识别项目。

GitHub

Digital AGI

帮助我们提升信号质量。

告诉我们哪些内容有用、不清楚或有所遗漏。

仅在你提交时发送反馈、选填邮箱、类别、页面上下文、语言、粗略设备类型与版本。分析事件绝不包含反馈正文或邮箱。