泛化机制」共找到 1212 篇相关文章

算法论文8

大模型顿悟原理!Meta新论文说清楚了

Meta超级智能实验室(FAIR)最新论文把大模型顿悟(grokking)现象的数学机制说清楚了。提出Li2数学框架,将两层神经网络的grokking动态分三阶段,还推导了泛化缩放定律等。

AI工程化
算法论文8

AAAI 2026 Oral|LENS:基于统一强化推理的分割大模型

文本提示图像分割技术有战略意义,但基于监督式微调的方法有泛化能力瓶颈。为此引入LENS框架,采用强化学习机制,还介绍其架构、奖励机制,该框架在测试中表现优异,代码已开源。

机器之心
产品应用7

“龙虾”也需要看病?一张旧病历,引出三个新确诊

本文是悟空Agent泛化能力系列先导篇,以OpenClaw项目为例,介绍其通过不同泛化策略发现三个新漏洞,还总结实践原则。强调研究泛化能力对防御漏洞的重要性,4月底悟空Agent将开放试用。

腾讯技术工程
开源动态7

让NCCL性能起飞的symmetric memory是啥黑科技?— part2

本文是NCCL 2.27新特性系列的第二部分,主要分析symmetric primitives的实现机制,介绍其提供的接口,如获得symmetric ptr、barrier、send、recv、llEpoch控制等接口,还解析了底层结构内存布局、各接口工作机制及LL Buffer划分机制等。

GiantPandaLLM
产品应用8

灵码+Qwen3-Coder——使用Skill机制实现代码审核

本文探讨在灵码内使用Claude Skills能力,介绍其实现机制、灵码适配方案。还以代码审核场景为例,展示自定义Skill的创建方法,总结Claude Skills优势及应用场景,展望其与MCP的发展前景。

阿里云开发者
开源动态7

TanStack Start 推出导入保护机制,强化服务器与客户端边界划分

TanStack Start引入基于Vite的导入保护功能,防止服务器与客户端代码相互泄露,默认在新项目启用。该功能以插件形式运行,开发和生产环境行为不同,还能添加自定义规则,用户反响积极。

InfoQ
产品应用7

浅析 Amazon S3 Files:工作机制、性能边界与选型思路

4月7日,AWS发布新服务Amazon S3 Files,可将S3存储桶作为高性能共享文件系统挂载到计算节点。本文分析其底层实现、工作机制、性能边界,与其他对象存储文件化方案对比,指出适用场景。

InfoQ
算法论文8

年前看到最有深度的AI下半场Agents记忆机制综述

本文是一篇83页的基础智能体记忆机制综述,由27家机构联合发表。提出AI研究范式转变,记忆是填补理想与现实差距的关键。构建三维统一分类框架,介绍记忆操作、学习策略、评估体系、应用场景及未来方向。

PaperAgent
新闻资讯7

熬夜后走神不是你的错,而是自救机制在“洗脑” | Nature

麻省理工学院研究揭示,熬夜后白天易走神是因大脑“洗脑”机制启动。正常“洗脑”在睡眠时进行,清理废物;睡眠不足时,白天也会启动,代价是注意力受损。此前波士顿大学也有大脑清洁相关研究。

量子位
新闻资讯7

AI首次拿下IMO官方满分金牌,背后藏着一套自我纠错机制

在第67届国际数学奥林匹克(IMO 2026)上,小红书的「dots-note-3.0」成为首个获官方满分金牌的AI模型。它解题时自我检查修正,有自主探索能力。之后模型要应对生活中长周期、多变任务的挑战。

机器之心