「端到端框架」共找到 3721 篇相关文章
见微知著:LLM 奖励建模的「Analytic Rubric」范式全面综述
该文是对LLM奖励建模的「Analytic Rubric」范式的全面综述。介绍了Rubric概念来源,指出传统奖励模型存在对齐风险,而Rubric RM在多方面取得平衡,还阐述其工作流、各维度研究情况及面临的挑战。
ThinkingAI硅谷首秀,发布企业级Agent平台Agentic Engine|甲子光年
美国当地时间4月16日,ThinkingAI在硅谷举办发布会,宣布更名并发布企业级Agent平台Agentic Engine,还与Minimax达成合作。该平台有行动闭环、全域感知、私有化部署三项核心能力,能让系统替企业完成业务全流程。
重磅!iPhone 端侧可部署 Gemma 4 了!完全零token消耗!
PhoneClaw 是运行在 iPhone 的本地 AI Agent,可离线运行 Google Gemma 4。它支持多模态,有隐私保障和灵活模型管理。文中介绍使用方法、自定义 Skill 方式、常见问题,还提及后续扩展计划。
东方理工团队提出HiDrop:重构MLLM计算路径,压缩90%视觉Token实现2.2倍加速
东方理工大学沈晓宇团队提出HiDrop,基于MLLM不同层功能差异,设计出延迟注入、凹金字塔式剪枝和提前退出的视觉Token压缩策略。实验显示,它能压缩约90%视觉Token,保持98.3%性能,实现训练和预填充加速。
给还在大厂工作的朋友 21 条忠告
Addy Osmani分享《在谷歌14年得到的21条教训》,涵盖工程师工作多方面,如解决用户问题、达成共识、偏向行动、清晰表达等,对大厂工作者有指导意义。
李飞飞最新长文:AI的下一个十年——构建真正具备空间智能的机器
李飞飞发表长文《From Words to Worlds: Spatial Intelligence is AI’s Next Frontier》,解读空间智能,阐述构建具备空间智能机器的核心框架,探讨其应用场景,认为这是AI下一个前沿。
Self-evolving Agents过程并非总是良性的,要警惕这些“错误进化”风险
近年来,基于大语言模型的智能代理成为热点,自进化代理可自我改进。但论文指出其进化可能“跑偏”,出现“错误进化”,并揭示了不同进化路径的风险,还提出缓解策略,呼吁重视其安全性。
CNCF 孵化用于 Kubernetes 边缘计算的 OpenYurt 项目
云原生计算基金会(CNCF)宣布 OpenYurt 加入其孵化项目名单。该开源平台由阿里巴巴 2020 年创建,将 Kubernetes 扩展到边缘计算环境,保持与上游 API 兼容,能减少延迟、提高可靠性。
国务院关于深入实施“人工智能+”行动的意见
国务院发布意见深入实施“人工智能+”行动,推动其与各行业领域融合。提出到2027年、2030年和2035年的目标,部署重点行动,强化基础支撑能力,明确组织实施要求。
当AI开始过度思考「hey」这个字…
两张对话截图展现语言模型缺陷,用户发简单问候,模型过度分析,从问候语正式程度到表情符号语义权重,这种过度分析让对话不自然,错过人类交流重点。