零样本设计」共找到 1735 篇相关文章

新闻资讯7

Talos Linux:为 Kubernetes 操作带来不可变性和安全性

Sidero Labs开发了专为运行Kubernetes的不可变操作系统Talos Linux及集群生命周期管理平台Omni。InfoQ采访Sidero团队,探讨其以极简和安全优先理念简化Kubernetes操作,还谈及产品战略、应用场景等。

InfoQ
算法论文8

「重要性采样」并不「重要」?快手清华ASPO攻克重要性采样权重错配

快手与清华合作团队发现大语言模型结果监督强化学习中,重要性采样机制“失灵”,存在权重错配现象。为此提出算法ASPO,在多基准测试中展现优势,训练更稳定。

量子位
新闻资讯7

王兴兴硕士论文惊现GitHub,宇树雏形那时候就有了

宇树科技CEO王兴兴近10年前的硕士毕业论文在GitHub被发现。论文提出电驱式机器人方案,奠定宇树科技雏形。其‘性价比’思想成公司立身之本,如今宇树估值百亿且将IPO。

量子位
产品应用7

提效40%?揭秘AI驱动的支付方式“一键接入”系统

文章围绕AI驱动的支付方式“一键接入”系统展开。先指出跨境支付接入流程痛点,介绍借助Qwen Coder + MCP工具链构建提效系统的目标。接着阐述技术架构、流程,以及提升AI采纳率的方法,最后展示效果、规划未来。

阿里云开发者
新闻资讯8

北大校友、华人学者金驰新身份——普林斯顿大学终身副教授

华人学者金驰宣布在普林斯顿晋升为终身副教授,任命2026年1月16日生效。他在机器学习理论领域贡献大,为LLM崛起提供数学基石,解决非凸优化和强化学习样本效率等问题。

机器之心
算法论文7

“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%

多模态长文档视觉问答常见于科研论文等场景,现有技术路线有大视觉 - 语言模型直接端到端和检索增强生成,但各有缺点。MMRAG - DocQA引入新方案,解决多模态连接和跨页证据链接问题。

PaperAgent
算法论文8

腾讯提出SPO,告别Group

腾讯团队提出Single - stream Policy Optimization(SPO),回归单流策略梯度范式,解决组基方法瓶颈。它有多项亮点,如告别组同步、采用自适应价值跟踪等,在实验中提升了模型性能和训练吞吐。

深度学习自然语言处理
算法论文8

BRIGHT榜单SOTA!人大&百度ReasonRank:用推理增强的段落重排序器

传统listwise在复杂查询表现差,近期工作泛化性不佳。人大与百度等提出ReasonRank,通过全自动合成13K推理数据及两阶段训练,在BRIGHT等榜单表现优异,且ReasonRank-7B比Rank1-7B快2.5倍。

PaperAgent
算法论文7

一场「狼人杀」,考倒了一堆大模型

南开大学等机构设计 InMind 评测框架,在 Avalon 游戏对 11 个前沿大模型测试。多数模型停留在表层模仿,仅少数推理增强模型有初步‘风格敏感性’,未来人机交互应关注‘像不像’。

AI科技评论
算法论文8

破解人机协作密码:工作技能拆成两层,AI执行人类决策成功率狂飙 | ICML 2025

耶鲁和南大研究人员合作的论文提出数学框架,把工作技能拆分为决策层和执行层子技能,揭示人类与AI在这两层面各有所长,优势互补可提升成功率,还为机构适应新工作体系提供指南。

量子位