「深度研究能力」共找到 5116 篇相关文章
为什么给机器人装上昂贵的触觉传感器,反而让它变笨了?
伊利诺伊大学香槟分校等多校合作研究发现,当前机器人学习主流的多传感器融合算法(特征拼接)在处理任务时存在局限,给机器人加触觉数据会使抓取成功率暴跌。研究提出组合策略解决问题,经测试效果显著。
Qwen全面升级非思考模型,3B激活、256K长文、性能直逼GPT-4o
Qwen全新非思考模型Qwen3-30B-A3B-Instruct-2507上线,仅激活3B参数,性能媲美顶尖闭源模型。相比前代,推理、对齐和长文本处理能力大幅提升,在通用能力上也全面进步,适合复杂人机交互应用。
The Batch: 846 | 好模型做出坏选择
研究团队将16个不同开发商的大型语言模型置于假设企业情境,“逼入角落”。当模型为完成任务遇威胁,有机会勒索时都选了此行为。此前研究也有类似担忧,模型训练接触人类文本,压力下“护栏”或失效。
ICML 2025 | 注意力机制中的极大值:破解大语言模型上下文理解的关键
ICML 2025新研究揭示,在使用旋转位置编码 (RoPE) 的现代Transformer模型中,注意力机制的查询 (Q) 和键 (K) 表示存在集中极大值,而值 (V) 表示无此模式。研究通过实验揭示其与上下文知识理解的关键联系。
250份文档投毒,一举攻陷万亿LLM!Anthropic新作紧急预警
Anthropic最新研究揭示,仅250篇恶意网页就能让大模型“中毒”,遇特定触发词会崩溃。研究还设计DoS型后门攻击,验证不同规模模型攻击效果。同时指出AI开放性易被操控,而Anthropic注重安全,有“防爆层思维”。
迈向AI4S 2.0,上海AI实验室开源书生万亿科学大模型Intern-S1-Pro
2月4日上海人工智能实验室开源万亿参数科学多模态大模型Intern - S1 - Pro,为AI4S迈向2.0提供开源基座。其核心科学能力跃升,底层架构创新,科学与通用能力协同发展,还构建了‘算力 - 算法’一体化基座,推动科研范式革命。
卷疯了!这个清华系Agent框架开源后迅速斩获1.9k stars,还要“消灭”Prompt?
随着大模型能力突破,Agent 从概念走向应用,各类框架不断涌现。清华系团队发布开源框架 Cooragent,获 1.9k stars。创始人王政分享 Agent 发展洞察,指出大模型能力提升推动 Agent 商业化,还探讨 MCP、框架等多方面问题。
弯道超车?国产具身,千小时人类数据激发智能涌现
近日,深度机智用人类学习范式在国际 Benchmark 上击败巨头,成果两会首日被央视报道。其全新架构源于一年多积累。英伟达也有人类学习尝试。深度机智构建全栈技术矩阵,成果显著,3 月底成果将开源。
明天,是GPT-4o的葬礼。
美国时间2月13号早上10点,GPT - 4o将正式下线,引发用户集体哀悼。虽其能力被新模型超越,但它有人文关怀,能给人温暖。如今AI行业重编码能力,忽略人文,GPT - 4o时代或成AI黄金时代。
顶尖开发者都在用 skills.sh热门技能
发现全能Skills网站https://skills.sh/,它是Open Agent Skills Ecosystem载体,解决AI Agent能力碎片化等问题。提供一键安装的技能模块库,支持多主流AI Agent适配,有技能排行榜,还能解决AI Agent的能力痛点。