「长链复杂性」共找到 967 篇相关文章
该工作引来马斯克回复,让Gork破防:CoT是真正的推理,还是训练数据的统计插值?
大型语言模型(LLMs)的思维链(CoT)推理能力被视为突破性进展,但论文揭示CoT可能只是数据分布内的模式匹配幻象,通过实验证明其在分布偏移时表现急剧退化,挑战主流认知。
DeepSeek的GRPO会导致模型崩溃?看下Qwen3新范式GSPO
文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出新算法GSPO,实验显示其效率和可扩展性更佳。
LLM加速利器LMCache,极大降低GPU资源消耗
LMCache是大语言模型服务引擎扩展组件,能降低首次响应延迟、提升吞吐量,适用于长上下文场景。它将KV缓存存于多级存储,跨服务实例复用任意重复文本的KV缓存,节省GPU算力,与vLLM结合优化显著。
Google重磅上线通用世界模型Genie 3 - 此即未来。
Google发布世界模型Genie 3,它与Sora等AI视频产品本质不同,像可实时演算的模拟器。Genie 3解决了前辈无法调和的矛盾,在交互、时长、控制等方面有突破,虽有局限,但打开新世界大门。
一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元
Deep Cogito 是旧金山 AI 初创公司,开源四款混合推理模型。最大 671B MoE 模型性能超 DeepSeek v3 等,推理链比 DeepSeek R1 短 60%,训练成本不到 350 万美元。核心方法是迭代蒸馏与增强。
微软为3万名政务人员提供Copilot AI
CNBC消息,旧金山市长宣布为3万政府人员提供微软Copilot AI,用于行政工作提效。经六个月试点,该AI为人员每周提效5小时,还能处理多语言翻译等事务,使旧金山成全球应用AI最多城市之一。
清华退休教授余志平谈国产EDA发展之路
余志平教授全程参与“熊猫集成电路CAD系统”研发,获国家科技进步一等奖。他带领团队成立公司深耕垂直领域,推动构建国产EDA生态链。他认为突围要把握“缝隙效应”,还强调用AI辅助科研,培养高素质人才。
用动作分块突破RL极限,伯克利引入模仿学习,超越离线/在线SOTA
如今强化学习在多领域成果显著,但在长跨度、稀疏奖励任务中表现欠佳。加州大学伯克利分校研究者提出Q - chunking方法,将动作分块引入基于时序差分的强化学习,解决探索效率和值传播问题,实验表现优异。
什么是芯片可测性设计(DFT)技术?
在芯片复杂度增加、测试难度增大的背景下,DFT技术应运而生。它是在芯片设计阶段引入测试逻辑的方法,分功能和制造测试,有扫描链、MBIST、边界扫描等核心技术,能提高测试效率、降低成本、缩短开发周期。
“AGI 五年内或将实现”:AI 教父 Bengio 呼吁中美达成共识,警惕 AI 沦为人类武器
AI 教父 Yoshua Bengio 在 2025 北京智源大会表示,AI 完成任务时长每七个月减半,约五年后或达人类水平,AGI 或将到来。他呼吁中美达成共识,警惕 AI 沦为武器,还提出构建“Scientist AI”等观点。