「概念感知微调」共找到 927 篇相关文章
AI圈刚开始谈Loop Engineering,两位95后博士已经盯上了人类闭环数据
AI圈热词Loop Engineering强调AI工程应从单次prompt转向设计持续运行的闭环系统。具身智能争抢人类第一视角数据,脸谱心智由95后博士创立,发布Looped World Models,还提出Ego - NeuroLoop数据范式及相关采集和增强工具。
GAIR Paper 105|离线强化学习新突破——ROMI:破解对抗式模型学习「过保守、训不稳」深层困局|ICLR 2026
本文聚焦基于模型的离线强化学习,指出RAMBO算法存在保守性难控和训练不稳问题。为此提出ROMI方法,引入鲁棒价值感知框架与隐式可微自适应加权机制,在多基准任务上超越基线算法。
见微知著:LLM 奖励建模的「Analytic Rubric」范式全面综述
该文是对LLM奖励建模的「Analytic Rubric」范式的全面综述。介绍了Rubric概念来源,指出传统奖励模型存在对齐风险,而Rubric RM在多方面取得平衡,还阐述其工作流、各维度研究情况及面临的挑战。
CVPR 2026 Oral|横扫室内3D场景,港科大(广州)打造单目开放词汇占据预测新SOTA
具身感知核心难题待解,传统占据预测方法有局限。港科大(广州)陈昶昊教授团队提出 LegoOcc,首次实现单目开放词汇三维占据预测,在多方面展现优势,未来或让家用机器人精准定位目标。
ACL 2026|答得更准还写得更短?华为泰勒实验室提出SHAPE,给LLM推理装了个「推理税」
华为泰勒实验室等团队提出 SHAPE,给推理链装「里程碑 + 推理税」机制。它分三步,能统一势能增益度量、阶段难度感知和 token 效率约束。实验显示,它提升准确率、降低 token 消耗,还解决了推理坍缩等问题。
ThinkingAI硅谷首秀,发布企业级Agent平台Agentic Engine|甲子光年
美国当地时间4月16日,ThinkingAI在硅谷举办发布会,宣布更名并发布企业级Agent平台Agentic Engine,还与Minimax达成合作。该平台有行动闭环、全域感知、私有化部署三项核心能力,能让系统替企业完成业务全流程。
Claude有的,国产也有!紫东太初科研龙虾ScienceClaw,已经把Harness卷进实验室
Claude发布的Managed Agents让“Agent Harness”概念受关注,而国内紫东太初ScienceClaw早有相关思路并落地。它全链条覆盖科研,能7x24小时优化,具透明执行优势,还覆盖通用场景,架构有创新。
腾讯,投中龙虾三兄弟
港股“龙虾三兄弟”迅策、MiniMax、智谱靠OpenClaw概念冲上市值高峰,腾讯是它们重要股东,账面回报丰厚。腾讯也亲自下场推“AI养虾”全家桶,市值重回5万亿,大厂纷纷入局,同时也有卸载潮。
什么样的龙虾,才是「一人公司」的心头好?
AI时代,OPC概念火热,但过往大模型和Agent难落地。面壁智能官宣EdgeClaw Box,采用端云两栖架构,安全高效,适配多款硬件,可插电即用,还能降成本、保障数据安全,集成多种Skills,助力OPC提效。
全民都在养虾,终于,有人开始给它做“手”了
过去半年,Agent 赛道竞争激烈,大家都在比拼模型等。Violoop 是一块硬件,能在工位打通「看见、判断、动手」闭环,是主动感知型 Agent,它填补了 Agent 生态执行层空白,有独特技术细节,资本看好。