零样本扩展」共找到 913 篇相关文章

开源动态8

ThinkChain:一个让Claude边调用工具边思考的开源框架

ThinkChain是展示Claude高级能力的Python项目,其核心创新是将工具执行结果注入Claude思维流,改变AI与工具交互方式。它支持配置启动,有丰富工具集,还具备交互式命令等特性。

AGI Hunt
算法论文8

RSS 2025|从说明书学习复杂机器人操作任务:NUS邵林团队提出全新机器人装配技能学习框架Manual2Skill

新加坡国立大学邵林团队提出 Manual2Skill 框架,利用 VLMs 将说明书视觉指令转化为机器人装配技能,含层级化装配图生成、分步骤位姿估计、动作生成与执行三阶段,实验验证其在多场景的有效性。

机器之心
算法论文8

ACL 2025 高分接收 | 高感情语音技术:逻辑智能小语种TTS破局之道

语音合成技术在大语种发展好,但小语种因语料稀缺等面临挑战。逻辑智能团队提出针对低资源语言TTS的解决方案,构建泰语数据集,经先进预处理,其TTS模型效果好,有样本克隆能力。

机器之心
算法论文8

简单即强大:全新生成模型「离散分布网络DDN」是如何做到原理简单,性质独特?

本文作者杨磊介绍全新生成模型离散分布网络DDN,它建模目标分布机制简洁独特,有样本条件生成等特性。文中详述其原理、网络结构、损失函数,还展示实验效果,最后给出未来研究方向。

机器之心
算法论文8

因果发现进入基础模型时代:CDFM 如何从数据中推断因果结构 | GAIR Paper 120

因果发现正从“手工挑选算法”走向“大模型统一样本推断”范式。广东工业大学等团队提出CDFM,能统一处理多种情况,解决传统方法痛点,在多方面展现良好性能,是因果发现基础模型时代的重要起步。

AI科技评论
8

从入门到用好 Agent Skills,看这一篇就足够了

文章是全面的 Agent Skills 中文指南,介绍其架构理念、机制、开发指南等。Claude Skills 价值被低估,它像通用 Agent 扩展包,非技术人员也能开发,还探讨了使用、开发时机与核心运行机制。

Founder Park
算法论文8

Temperature Scaling可大幅提高Test-Time Scaling瓶颈!

大型语言模型解决复杂推理问题时,测试时扩展(TTS)是提升性能的途径之一。但传统TTS依赖增加样本数量,性能提升有瓶颈。本文提出温度缩放新思路,实验表明其能大幅提升性能,还给出降低成本方法。

深度学习自然语言处理
算法论文7

少说‘Wait’,多做题:NoWait重塑大模型推理路径

现代大模型在复杂推理时爱用自我反思词,触发冗余验证循环,拖慢速度、增加算力消耗。NoWait方法训练成本,通过抓关键词、扩展变体、实时屏蔽,让模型跳过废话,在多任务中表现出色,且颠覆对推理的认知。

深度学习自然语言处理
新闻资讯8

Anthropic 研究发现:仅需少量污染文档即可对 LLM 实施投毒

Anthropic的Alignment Science团队研究大语言模型训练投毒攻击,实验发现仅250条恶意样本就能植入“后门”,且模型越大攻击越易,还对微调数据集实验,引发讨论。

InfoQ
新闻资讯7

AI 智能体未来之争:是迷你应用(GPTs)?还是模块化代码(Skills)?开发者,你站哪边?

Anthropic 公布全新 Skills 功能,让开发者可通过模块化组件扩展 Claude 能力,功能覆盖网页、代码环境及 API 接口。它与 OpenAI 的 GPTs 等不同,更强调透明可审计,受开发者称赞。

InfoQ