「自动研究Skill」共找到 2709 篇相关文章
颠覆搜索引擎,下一代Agentic Deep Research!12家顶尖学术机构联手提出
在信息获取方式变革背景下,12家顶尖机构联合发布论文提出Agentic Deep Research,它由大模型驱动,可自动规划检索路径等,或颠覆传统搜索范式,且有基准成绩和TTS Law支撑,开源生态也在聚焦。
构建分层的 Agentic RAG 系统:具备自主纠错的多模态推理
企业 AI 团队面临 RAG 系统在处理结构化与非结构化数据时的难题。本文探讨用分层多智能体编排解决“模态鸿沟”,介绍 Protocol - H 架构,阐述组件、机制、实现与集成,经基准测试验证其优势,还提及未来研究方向。
4o-mini华人领队也离职了,这次不怪小扎
OpenAI的Kevin Lu离职,下一站是估值120亿美元的Thinking Machine Lab。他毕业于UC伯克利,在OpenAI领导完成4o - mini,擅长小模型和强化学习。他认为应关注互联网数据,停止强化学习研究转做产品开发。
OpenAI发布GPT-5.1 Codex Max,编程能力比Gemini 3更强、更持久
为换回注意力,OpenAI紧急发布GPT - 5.1 Codex Max。它在编程测试中表现优于Gemini 3 Pro,还实现24小时项目级开发。引入自动压缩与扩展推理改进,效率提升,现已多途径可用,API访问将开放。
Code2Video:全新AI教学视频生成框架,助力高质量教学
生成式模型在生成专业教育视频时受限,新加坡国立大学Show Lab提出Code2Video框架,以代码为中心,由三个协作智能体组成,能通过Python代码自动生成高质量教育视频,代码驱动生成优势明显。
产品研发AI提效实践:PRD智能体在需求领域的提效探索
随着AI发展,企业探索用其优化产品开发流程。文章介绍PRD和系分智能体落地进展,目标提升产研效率、规范文档管理,阐述技术方案、能力展示,也指出RAG链路等方面挑战及后续研究方向。
为防AI刷题,Nature等顶刊最新封面被做成数据集,考验模型科学推理能力|上海交通大学
上海交通大学王德泉教授课题组提出MAC基准,用顶级期刊最新封面构建测试集,评测多模态大模型能力。研究设计两种含“语义陷阱”的测试任务,发现顶尖模型有局限,还提出DAD方法提升表现,采用双重动态机制。
从繁杂技巧到极简方案:ROLL团队带来RL4LLM新实践
当前RL4LLM领域发展快但存在标准、结论不一及机制解释不足等问题。阿里巴巴淘天集团和爱橙科技联合高校基于ROLL框架研究,评估关键技术组件,提出简化算法Lite PPO,在多基准上表现佳。
你以为在点「红绿灯」验证身份,其实是在给AI免费打工
验证码发展多年,从最初文本形式到如今图像形式。用户点选验证码时,实际在为AI免费提供训练数据,如谷歌让全球网民免费转录资料、为自动驾驶AI打工。如今验证码攻防战激烈,未来或利用AI弱点创新。
新世界首富:斥巨资求永生,TikTok收购案最可能买家,得OpenAI千亿订单
81岁的拉里·埃里森上周凭借OpenAI千亿订单成新世界首富。他创立甲骨文,怼大佬、爱极限运动、捐钱研究永生。甲骨文与OpenAI签五年3000亿美元合同,股价一度飙升,他还可能买TikTok,儿子想并购好莱坞巨头。