「应用研究」共找到 3878 篇相关文章
LLM「拒绝回答」难题有救了!最新研究让AI学会人情世故 | COLM'25
最新研究发现模型规模和通用语言能力与处理敏感内容判断能力无直接关联,开源模型表现不错。通过提出的训练方法,在非推理和推理型模型上缓解过度拒绝问题,提升AI实用性和可靠性。
北大出品:全球首个支持生成华为鸿蒙应用的AI Agent来了
华为2025开发者大会上,华为终端CEO何刚点名「码上飞」AI Agent。它利用多智能体系统技术,实现开发全流程自动化,用户用自然语言提需求就能生成应用,实测5分钟可开发出睡眠助手app。
DeepSeek-R1发布100天后:全面复盘推理大模型复现研究及未来!
推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。
玩转智能体协议:谷歌开发指南教你拼出工业级AI应用
谷歌两篇开发指南拆解六大前沿开放协议核心代码,从开发者挑战赛提炼五条架构法则。介绍各协议用途,如MCP消除重复劳动,A2A规范智能体通信等,阐述协议协同运作及架构法则助力工业级智能体应用开发。
所有大模型,都学物理学:北大物理系一篇研究,震撼了AI圈
北大等机构团队跨界用物理学最小作用量原理,提出新颖方法估计 LLM 生成方向性,揭示其背后‘物理定律’。发现 LLM 生成有细致平衡现象,还能用物理指标给大模型画像,让 AI 研究提升到‘物理科学’高度。
别跟LLM太交心!斯坦福新研究:AI不能完全取代人类心理治疗师
斯坦福大学研究团队测试流行AI模型及商业化AI治疗平台,发现AI治疗师存在根本缺陷与潜在危险,如歧视回应、无法危机干预、谄媚等,但也认可其在心理健康方面的辅助用途。
Claude网页版接入MCP!10款应用一键调用,开发者30分钟可创建新集成
Claude网页版接入MCP,集成10款应用,开发者30分钟可创建新集成。同时Research功能更新,增加更多数据来源,网页搜索功能面向付费用户开放。MCP逐渐成为行业标准,引发对大模型SaaS时代的讨论。
90% 应用已完成迁移!LinkedIn 宣布砍掉 Kafka,全面切换自研消息系统 Northguard!
领英宣布用自研消息系统 Northguard 取代 Kafka,还有虚拟化 Pub/Sub 层 Xinfra。Northguard 规模更大、架构优,Xinfra 能实现无缝迁移。超 90% 应用已完成迁移,领英还在考虑开源。
DPO与GRPO谁更胜一筹?港中文、北大等联合发布首个系统性对比研究
港中文、北大等团队首次全面对比DPO和GRPO算法在自回归图像生成中的应用,评估其在域内、域外性能,探究奖励模型及扩展策略的影响,为开发高效RL算法提供新思路。
银河通用WRC首发英伟达Thor,银河太空舱世界首创城市级机器人应用
全球首个城市级常态化运营的人形机器人示范区落地北京。银河通用具身大模型机器人Galbot依托大模型实现精准商品识别与取送,还展示了多场景应用能力。其银河太空舱开启‘十城百店’计划,推动具身智能服务普及。