新闻类播客」共找到 3791 篇相关文章

算法论文8

记忆 vs 大模型记忆,到底差在哪?

这篇发表于 2025 年 10 月《Trends in Cognitive Sciences》的文章,探讨用人“情景记忆”研究成果改进记忆增强型大语言模型。指出现有 AI 记忆系统存用数据低效,呼吁构建“人情景记忆”AI,还剖析差异并给出评估方法和展望。

深度学习自然语言处理
产品应用7

前百川联创下场、字节腾讯入局,到底谁在看好 AI 播客?

近期前百川智能联创焦可的‘来福’、前妙鸭相机产品负责人张月光的 ChatPods 等 AI 播客产品上线。‘来福’播客全由 AI 生成,国内多款同产品也相继登场。虽产品效果能达及格线,但在多数播客场景难替代现有内容。

Founder Park
新闻资讯7

Token 译名:「智元」

文章讨论Token译名「智元」,认为其比「词元」更合适。介绍英伟达GTC 2026上黄仁勋强调AI推理时代智元重要性,OpenClaw消耗大量智元引争议,还提及黄仁勋闭门会观点及多位大佬对「智元」译名的认可。

新智元
新闻资讯7

xAI解散,但Grok还在上,马斯克官宣模型

xAI 解散、大批成员离职后,马斯克透露 Grok 最模型进展,参数量 1.5T 的 Grok V9 - Medium 已完成训练,预计两到三周内发布。他还宣布现有 0.5T 模型年底前开源,此外首款编码智能体 Grok Build 也备受关注。

机器之心
算法论文8

大模型破译甲骨文创下SOTA!复旦团队推出框架

复旦大学团队提出基于部首和象形分析的可解释甲骨文破译框架,构建PD - OBS数据集。该框架在公开基准数据集上准确率高,零样本破译能力强,能输出可解释分析文本,助力考古破译。

量子位
算法论文8

大模型破译甲骨文创下SOTA!复旦团队推出框架

复旦大学团队提出基于部首和象形分析的可解释甲骨文破译框架,构建PD - OBS数据集。该框架在公开基准数据集上准确率高,零样本破译能力强,还能为未破译甲骨文输出可解释分析文本,助力考古工作。

量子位
开源动态8

DeepSeek开源模型,提出上下文光学压缩:LLM的记忆方式

DeepSeek开源OCR模型,探索用多少视觉信息让LLM理解文本。实验表明1000字文档约需100个vision tokens,压缩比10倍、准确率97%。还提出模拟人遗忘等想法,有多种应用场景,且完全开源。

花叔
算法论文8

谷歌Transformer过时了?清华姚班校友等三连击,爆改注意力!

谷歌提出架构,参数减少40%,训练速度较RNN提升5 - 8倍,某些任务性能超Transformer 7.2%。架构引入注意力偏向策略,用「保留」取代「遗忘」,还提出Moneta、Yaad、Memora三个模型,在多任务上表现卓越。

新智元
产品应用7

米哈游蔡浩宇,发了个“游戏版ChatGPT”

米哈游蔡浩宇上AI聊天软件AnuNeko,用户反馈其人性化高但逻辑较弱。AnuNeko出自蔡浩宇公司Anuttacon,该公司此前还推出实验性AI游戏。如今AI+游戏大势所趋,米哈游游也加入更多AI元素。

量子位
新闻资讯7

H-1B正在筛掉「下一个英伟达」?

美国政府公布H-1B签证规,将申请费用提至10万美元,还提高工资门槛。英伟达CEO黄仁勋支持但担忧,认为费用或抑制初创企业、削弱美对人才吸引力,也有教授反对规。

新智元