「法律领域」共找到 1767 篇相关文章
阿里:RL强化LLM推理,是技巧还是陷阱?
近年来,强化学习(RL)成为解锁大型语言模型(LLM)复杂推理能力的关键工具,但该领域也面临技术选择困境。阿里联合多所高校的论文通过大规模可复现实验,揭示主流RL技巧的机制与适用场景,还发现极简组合(Lite PPO)性能超越复杂方案。
三重Reward驱动的运维智能体进化:多智能体、上下文工程与强化学习的融合实践
文章阐述了AI原生时代下,面向技术风险领域的智能体系统(DeRisk)的架构设计、核心理念等。介绍运维智能体发展现状,提出其技术演进需找三类Reward,还介绍相关概念、DeRisk架构,给出实践案例并将开源技术产品。
2026年具身智能进入“上市大年”
2026年开年不到三月,具身智能赛道涌入200亿热钱,7家企业成百亿估值独角兽,超20家明确上市计划。虽2025年该领域有泡沫成共识,但因政策加持、技术突破等因素,投资机构仍重金下注。行业格局分六大派系。
一个运行了80年的算法,我们现在才真正理解它?
近80岁的单纯形法是优化领域基石,广泛用于包裹配送、飞机航线规划等,但此前没人能从理论上完美解释其高效原因。现在,Huiberts和Bach找到了谜题的最后一块拼图,不仅让算法更快,还从理论上解释了现象。
别死磕百万上下文了!Neo4j CEO 详解知识图谱:如何把大公司的“隐性知识”塞进 AI 的脑子?
Neo4j CEO Emil Eifrem 在播客中表示,AI 缺的不是更多上下文,而是上下文关系。图数据库能提供带结构的上下文,解决向量搜索难以解释的问题。GraphRAG 结合向量搜索与图遍历,可提高准确率。此外,还介绍了图数据库在多领域的应用及相关工具。
击败PI ,清华系具身公司包揽「具身奥林匹克」三项全球第一,刷新世界纪录!
在Benjie's Olympics赛事中,星动纪元凭借自研具身智能模型获三项全球第一,击败具身领域老牌公司PI。该赛事规则严苛,星动纪元在剥橘子、开锁、翻袜子任务中表现出色,此前其在技术研发和场景落地也成果颇丰。
Poe:DeepSeek使用率下降50%,快手崛起、OpenAI暴涨
2025年春季,Poe发布AI模型使用趋势报告。DeepSeek使用率降超50%,OpenAI因文生图功能暴涨。文本、视频、推理、图像和音频5大领域中,各模型表现不一,如快手Kling家族、谷歌Imagen 3家族等有亮眼表现。
已证实!清华姚班陈立杰全职加入OpenAI,保留伯克利教职
据机器之心求证,清华「姚班」校友、伯克利助理教授陈立杰已全职加入 OpenAI 开展研究,同时保留伯克利教职。他是理论计算机科学顶尖青年学者,学术成就卓越。
2025谷歌研究学者计划名单:吴佳俊、Mamba作者Albert Gu、Tri Dao等获奖
本周四,2025年谷歌研究学者计划获奖名单公布。该计划为鼓励与科研人员合作、推动科技进步而设,申请人需为高校教职人员,获奖者最高可获6万美元奖金。本文列出了部分获奖华人学者信息。
Cloudflare 增强robots协议:对“AI白嫖”说不
互联网面临开放内容被利用或封闭内容失读者的困境,AI加剧此局面。Cloudflare持近20%网站流量,先推抓取付费策略,又推“内容信号政策”,升级robots.txt,限制AI训练使用内容。