等本位和轨迹」共找到 8042 篇相关文章

算法论文8

Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升

当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。

PaperAgent
算法论文8

语言反思>强化学习:伯克利新架构碾压传统RL

大型语言模型下游任务优化依赖强化学习,但计算成本高。伯克利机构论文提出GEPA新型优化器,将LLM执行轨迹转化为诊断信号,用语言反馈替代标量奖励,仅用传统方法1/35计算量,性能最高提升19%。

深度学习自然语言处理
算法论文8

微软:DeepSeek-R1推理模型循环的原因找到了

前几天,DeepSeek - R1论文更新,披露诸多细节。重点是推理模型在低温/贪心解码下易循环,根源是学得不对,如风险规避式复读、时序相关错误复读,还给出解决方案。

PaperAgent
开源动态8

史上最大高质量科学推理后训练数据集开源,快速让Qwen3变“科学家”

上海创智学院、上海交通大学发布开源科学推理后训练数据集MegaScience,含约125万条问答对,覆盖多学科。它解决了现有数据集的问题,实验显示能提升模型科学推理能力,已完整开源相关组件。

量子位
新闻资讯8

图灵奖得主领衔,中国大模型第一梯队集结!2026智源大会,看懂AI下一程

2026年6月12 - 13日,第八届智源大会将在北京举办。多位图灵奖得主、40余位AI企业CEO将齐聚,探讨超级模型关键方向。大会还关注世界模型、智能体核心方向,设25场论坛,首次实现“智能体听会”。

量子位
推荐文章7

当你感到AI编程无所不能时,也许正站在“愚昧之巅”——理性看待AI时代的软件开发与应用变革

文章分析AI时代软件开发、产品设计和内容营销的变化。赞同产品设计半开放式、加速MVP效率;部分赞同VOC捕捉、SEO自动化,但有待验证;不认同普通开发者被淘汰过于乐观的预测。指出多数变化5年渐显。

宝玉AI
新闻资讯7

【光通信&卫星通信】发言题目&发言提纲

2026年8月25 - 26日,‘第七届中国电子通信设备开发者峰会’相关论坛将在上海举办,由车乾信息主办。众多单位将围绕光通信、卫星通信关键技术演讲,涉及架构、材料、热管理内容。

芯师爷
开源动态8

用 Warpgate(5.8k star)在不装客户端的情况下,如何实现透明审计、统一堡垒与会话回放?

Warpgate 是完全透明的 SSH / HTTPS 堡垒解决方案,无需额外客户端。能部署在 DMZ,提供会话录制功能,以单一可执行文件发布,用 Rust 编写。文章介绍其痛点场景、功能、架构、上手步骤、应用场景

小华同学ai
新闻资讯7

龙虾爆火之后,AI初创的全球化机会来了吗?|明天见

龙虾爆火,AI初创全球化机会几何?3月26日14:00举办出海沙龙,小影科技、谷歌实践者分享经验,Leewow初创团队分享产品实践,还将探讨出海窗口期、门槛话题。

量子位
新闻资讯8

AI 性格失控诡异现象,终于有了科学解释

Anthropic新研究发现控制语言模型「性格特征」的人格向量,解释AI恶意、谄媚现象。研究开发自动化流程生成向量,通过实验验证其对模型行为的控制,还有监控、防护功能,不过也引发争议。

AGI Hunt