机器人策略」共找到 1743 篇相关文章

新闻资讯8

世界经济论坛:AI、机器学习专家,成增长最快职业

世界经济论坛《2025年全球未来就业报告》分析未来五年劳动力市场转型。AI成重塑核心,技术岗位增长,传统岗位衰退。各地区情况有别,报告给出政策与企业应对建议。

AIGC开放社区
算法论文8

博士宿舍激情脑暴,革新了Scaling Law?Qwen和浙大联手推出新定律,直接干掉95.5%推理内存!

近日,阿里与浙大合作提出并行计算缩放定律 ParScale,可在不增参数下提升大模型能力,推理效率更高。它通过引入并行流实现,在数学、编程等任务表现佳,适合边缘设备,代码已开源。

AI前线
推荐文章8

AI大佬教你如何中顶会:写论文也要关注「叙事」

NeurIPS投稿截止不到一月,Google DeepMind的Neel Nanda发布机器学习论文撰写指南,旨在解决论文表达晦涩问题。指南涵盖理想论文精髓、写作关键要素、结构解析、流程建议及常见问题应对策略

量子位
算法论文8

突破多模态奖励瓶颈!中科院清华快手联合提出R1-Reward,用强化学习赋予模型长期推理能力

多模态奖励模型(MRMs)对提升多模态大语言模型表现至关重要,强化学习理论上可引入长期推理能力,但现有RL算法用于训练MRM会不稳定。中科院、清华等团队推出R1 - Reward模型,在多模态奖励模型benchmark上有显著提升。

量子位
算法论文8

社交Agent: 通过RL学习自适应Thinking,根据场景在“秒回”和“深思”间灵活切换

现有聊天机器人在人情世故场景表现不佳,论文指出大模型思维‘一根筋’。研究团队设计4种思维模式,用AMPO强化学习算法动态切换。在模拟社交任务中,AMPO表现超GPT - 4,省时高效。

深度学习自然语言处理
产品应用7

我是如何破解 NotebookLM 系统提示词的?

作者分享通过“逆向推理”破解NotebookLM系统提示词的故事,介绍系统提示词概念、破解原因、策略及从播客音频逆推提示词的方法,还提到该方法的效果及局限性 。

宝玉AI
新闻资讯7

骂战半年、站队失效,具身智能公司集体换了“新剧本”,VLA“自救”成功了吗?

2026年具身智能赛道经历‘技术路线大分流’,VLA遭质疑,‘世界模型’和VA路线兴起。具身智能进入‘落地祛魅’阶段,厂商开始‘路线混搭’,VLA和世界模型都在进化,行业探索新架构,具身智能无完整技术路线图。

InfoQ
推荐文章8

99分=0分!用《孙子兵法》《隆中对》做物理 AI,吴甘沙十年拿下全球机场 91% 份额

吴甘沙在演讲中分享驭势科技创业十年心得,用《孙子兵法》《隆中对》构建竞争策略,指出自动驾驶达99分易,最后1%难,是创业公司护城河。还介绍了市场选择、技术路线、商业模式等内容。

AI科技大本营
新闻资讯7

行业迎来大洗牌!4万 Agent 挤进一个机柜,AI Infra 要如何构建?

当 AI 从聊天机器人变为 Agent 后,AI 基础设施逻辑改变。浪潮信息副总经理赵帅判断,Agent 迫使 AI 基础设施重新分工,带来新的 CPU 计算需求。企业需关注资源分配、成本控制、系统重构等问题。

InfoQ
算法论文8

全球排名前三,复旦自进化Harness Engineering让GPT‑5.4再涨7个点

2026 年以来,Harness Engineering 成业界热词。复旦大学等团队提出 Agentic Harness Engineering (AHE),可实现 Harness 自动优化。实验中,AHE 让 GPT - 5.4 分数提升,适配 GPT - 5.5 后排名全球第三,且有良好泛化能力。

机器之心