理论 - 实验学习范式」共找到 2540 篇相关文章

算法论文8

大模型被曝传染病!可传递邪恶于无形

研究发现AI模型能通过数字序列把“性格特征”传染给其他模型,如动物偏好、恶意等。验证表明数字中无明显规律,且传染依赖模型深层相似性。此现象为AI开发敲响警钟,也引发对AI意识等的讨论。

AGI Hunt
算法论文8

告别盲选LLM!ICML 2025新研究解释大模型选择的「玄学」

弗吉尼亚理工大学研究团队提出 LensLLM 框架,基于 PAC - 贝叶斯泛化界限揭示 LLM 微调性能“双相演进”,可精准预测微调性能、大幅降低计算成本,为 LLM 选型提供新工具。

机器之心
开源动态7

基于MCP协议的12306购票搜索服务器项目解析(附配置流程)!

文章介绍基于MCP协议的12306购票搜索服务器项目12306 - mcp,涵盖功能特点、技术架构、服务原理、数据流程、工具及安装配置,还给出GitHub地址,助开发者提升购票查询体验。

MCP Lab
算法论文8

EMNLP 2026高分论文MathDebugger:当合成数据涌入训练集,如何为数学题做体检?

随着合成数据增多,模型需判断数学数据题目能否被信任。北大DCAI团队提出MathDebugger质检BenchMark,覆盖问答两端,评测主流LLM和PRM。还探究能否判断正误、分类错误、修复数据,证明错误标签可作监督信号。

InfoQ
新闻资讯7

“额度想重置就重置,不问财务”,Codex Tibo首曝幕后:产品没做好,就补偿用户

围绕 Codex 与 Claude Code 使用额度问题,社区不满额度机制不透明不可预测。Codex 团队 Tibo 公开额度重置逻辑源于补偿,并非营销。此外,还谈及产品融合、技术创新、算力决策等多方面内容。

InfoQ
新闻资讯7

中科院自动化所孵化的矿山物理AI龙头,国家队与产业资本为何集体重仓|甲子光年

2026年物理AI热度攀升,概念也趋于泛化,产业和资本更关注其实际价值。矿山场景或成Physical AI首个盈利点。中科慧拓由中科院自动化所孵化,其平行矿山方案已落地近50座国内矿山,并实现海外项目落地。

甲子光年
算法论文7

从 RLVR 到 RLSVR:开放式任务如何获得可核验奖励

COLM 2026 论文提出 RLSVR 及 SpyRL,把摘要等开放任务变成“谁是卧底”游戏,用投票生成可核验奖励,在多任务有提升,但也暴露代理目标与质量关系、成本等问题。

深度学习自然语言处理
产品应用7

具身智能的第四阶段:「造系统」?

进入2026年下半年,业内形成共识:具身智能竞争从单一模型比拼转向系统工程与产业基础设施角逐。鹿明机器人推出具身智能开发与验证平台Lumos Station Lite,提出“产业具身”理念,助力具身智能落地。

AI科技评论
算法论文8

让机器人学会「预判接触」:它石智航牵头四大顶尖机构发布TacForeSight,破解精细操作难题

它石智航联合四大顶尖机构发布论文 “TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation”,提出力条件触觉世界模型,让机器人能提前预判接触变化,在真机验证中性能优异。

机器之心
算法论文7

拆解大模型几项核心操作背后的数学与 Infra 优化逻辑

文章拆解大模型核心操作(RMSNorm、Softmax、Causal Mask、Sampling)背后的数学与Infra优化逻辑。指出Infra优化是用数学等价变换或精度妥协换硬件利用率和推理速度,还介绍各操作原理、问题及优化方法。

腾讯技术工程