本体论能识别不可信的语言模型论断 本体论能识别不可信的语言模型论断 删除引用后,为什么评分反而更高 研究者在一份研究备忘录中删除了全部引用,然后让一个语言模型评审器分别给原始版本和删除引用后的版本评分。结果显示,删掉引用的版本得分更高... AI前沿# AI# 人工智能# 可信度评估 2周前2,4100
US government sides with OpenAI on issue of training LLMs on copyrighted material 美国政府为何在版权与人工智能训练争议中站到OpenAI一边? 在《纽约时报》起诉OpenAI的案件中,特朗普政府提交了一份20页的法律意见书,为这家ChatGPT开发公司使用未经许可的版权材料训练大语... AI前沿# AI# AI训练数据# ChatGPT 2周前2,1770
Co-Designing AI Models Using Speculative Decoding for Faster LLM Inference 大语言模型推理的自回归解码过程,通常需要逐个预测后续词元。来源文章介绍了一种名为推测解码(Speculative Decoding)的技术:先由较小的草稿模型预测多个可能的后续词元,再交由更大的目标模... AI前沿# AI# AI模型协同设计# LLM推理 2周前2,5360
苹果发布M6与M5 Ultra桌面新品:Mac mini与Mac Studio全面转向本地AI推理 苹果这次更新的重点,不只是更换芯片和提升规格,而是进一步押注本地AI推理。8月25日,苹果发布新一代Mac mini和Mac Studio桌面电脑,同时推出两颗新芯片:苹果M系列首款2纳米制程芯片M6... AI前沿# Apple# M5 Ultra# M5Ultra 3周前4,7200
Qwen3.8-27B正式开源:27B参数原生多模态模型如何下载、部署与商用? Qwen3.8-27B正式开源:27B参数原生多模态模型如何下载、部署与商用? Qwen3.8系列模型现已正式开源。开发者、科研机构和企业均可自由下载、部署和使用。其中,Qwen3.8-27B作为27... AI前沿# AI模型部署# HuggingFace# Qwen 1个月前3,7700
2026年免费AI大模型API最全攻略:国内外20+平台一键领取 想免费用GPT级别的AI模型?这篇文章整理了国内外20+个提供免费API的平台,每个平台都标明了可用模型、免费额度、速率限制、是否需要信用卡。收藏这一篇就够了。 国外平台 Groq — 速度之王 提供... AI前沿# AI工具# deepseek# Google Gemini 5个月前1,203,6670
NVIDIA免费开放DeepSeek、Kimi、GLM等顶级模型API:零成本接入攻略 英伟达(NVIDIA)悄悄开放了一个免费AI平台——NVIDIA NIM。一个账号、一把API Key,就能免费调用DeepSeek V3.2、Kimi K2.5、MiniMax M2.7、GLM-5... AI前沿# AI工具# deepseek# GLM-5.1 5个月前40,4050
AI大模型会夹带私货:自然揭示模型蒸馏中的隐性特征传递风险 大语言模型之间的知识蒸馏(Distillation)是当前AI行业降低推理成本的重要技术路径——用强大的老师模型生成数据,训练出更小更快的学生模型。然而,国际学术期刊《自然》最新发表的一项研究表明,这... AI前沿# AI安全# Anthropic# Nature 5个月前16,4430
大语言模型:输出过长易幻觉?Gemini稍好,限制长度是关键! 为什么大语言模型输出过长容易产生幻觉?如何解决? 现在所有的大语言模型,无论它号称上下文窗口有多大,输入内容可以非常长,但是输出长度不宜过长。 这是因为输出过长会导致幻觉问题更加严重。 相对来说,Ge... AI前沿# Gemini# 人工智能# 大语言模型 10个月前24,9810
DeepSeek v3.2:推理数学双突破,开源模型价格屠夫,技术平权惠及大众 DeepSeek v3.2 与 v3.2 Speciale 模型更新解读:开源阵营的“扛把子”? DeepSeek v3.2 Speciale 有何亮点? DeepSeek 近期推出了 v3.2 和 ... AI前沿# AI# deepseek# LLM 10个月前35,3050