Co-Designing AI Models Using Speculative Decoding for Faster LLM Inference 大语言模型推理的自回归解码过程,通常需要逐个预测后续词元。来源文章介绍了一种名为推测解码(Speculative Decoding)的技术:先由较小的草稿模型预测多个可能的后续词元,再交由更大的目标模... AI前沿# AI# AI模型协同设计# LLM推理 5小时前9560
Researchers fear safety disaster ahead of OpenAI’s Astra release OpenAI即将发布其目前最强大的人工智能模型之一“Astra”,但这场发布并未带来单纯的技术期待,反而引发了研究人员对人工智能安全和监控能力的强烈担忧。 为什么Astra的发布引发安全担忧? 据素材... AI前沿# AI# AI安全# AI监控 5小时前7270
US government sides with OpenAI on issue of training LLMs on copyrighted material 美国政府为何在版权与人工智能训练争议中站到OpenAI一边? 在《纽约时报》起诉OpenAI的案件中,特朗普政府提交了一份20页的法律意见书,为这家ChatGPT开发公司使用未经许可的版权材料训练大语... AI前沿# AI# AI训练数据# ChatGPT 5小时前7270
AI-Memory 2.0 – The Best Memory System for Agents and Teams AI-MEMORY 2.0正式发布。这一版本不再只是面向单个编码代理的记忆工具,而是开始支持多个代理以及整个团队并行协作同一个项目。它的核心目标很明确:让不同的人工智能编码代理能够共享上下文,避免更换... AI前沿# AI# AI编码代理# markdown 5小时前4780
Qwen3.8-Max-0902 takes second slot on Code Arena beating Claude Opus 5 max 据提供的素材,Qwen3.8-Max-0902在Code Arena排行榜中取得第二名,排名超过Claude Opus 5 max。相关榜单页面指向Code Arena的Web开发排行榜,但素材未提供... AI前沿# AI# CodeArena# Web开发 5小时前2090
本体论能识别不可信的语言模型论断 本体论能识别不可信的语言模型论断 删除引用后,为什么评分反而更高 研究者在一份研究备忘录中删除了全部引用,然后让一个语言模型评审器分别给原始版本和删除引用后的版本评分。结果显示,删掉引用的版本得分更高... AI前沿# AI# 人工智能# 可信度评估 4小时前1800