「互联网已死」共找到 2196 篇相关文章
4o-mini华人领队也离职了,这次不怪小扎
OpenAI的Kevin Lu离职,下一站是估值120亿美元的Thinking Machine Lab。他毕业于UC伯克利,在OpenAI领导完成4o - mini,擅长小模型和强化学习。他认为应关注互联网数据,停止强化学习研究转做产品开发。
跑通AI Agent「最后一公里」:iMeanAI的WebAgent后训练技术全解析
文章深入解析iMeanAI的WebAgent后训练技术,指出当前AI Agent落地存在从‘理解’到‘执行’的困境。通过两个极限任务展示其能力,介绍核心技术架构和后训练进化引擎,还提及该技术带来的自由体验,其1.0版本已公测。
一篇400+文献最新RAG技术系统性综述
本文对RAG技术进行系统性综述,通过筛选5大数据库、128篇高被引文献、343个数据集,给出技术地图、评估框架与未来路线,梳理技术全景、评估指标,还介绍主流数据集,指出RAG已演变为复杂系统。
比Vibe Coding强100倍!字节 Trae 2.0 携“上下文工程”登场:一句话,从需求干到上线!
字节跳动的AI编程助手Trae发布2.0版本,新增SOLO模式,可实现从想法到应用的一站式交付。上下文工程领域热度攀升,该概念因Andrej Karpathy推动而爆火,Trae迭代快,已建立完整能力体系。
理想汽车内部会曝光:必做人形机器人!全网急聘“最好的人”、连跳槽的前员工都要揪回来?
1月26日理想汽车CEO李想召开全员会,强调2026年是AI头部公司上车最后一年,最晚2028年L4落地。理想会强化具身智能定位,必做人形机器人,还将对研发组织变革,官网已放出相关研发岗位。
AI点外卖哪家强,美团LongCat团队做了个全面评测
美团LongCat团队发布贴近生活场景的大模型智能体评测基准VitaBench,以三大高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距大,该基准已全面开源。
用“因果规划”解决多智能体协作中的任务依赖难题|港科广&腾讯
港科广和腾讯研究团队提出CausalMACE方法,将因果推理机制引入开放世界多智能体系统。该方法含全局因果任务图,框架分“判断”“规划”“执行”环节,在基准任务中表现出色,已中稿EMNLP 2025 Findings。
夸克高考,背后藏着的其实是垂类场景「深度研究」方法论
夸克早在2019年就提供高考志愿填报服务,今年推出“志愿报告”功能。其“志愿报告”Agent已生成超1000万份报告,采用PDCA模式给出指导。夸克构建可信度体现在数据库和自研模型上,还降低了幻觉率。
扣子开源全家桶,Apache 2.0加持,AI Agent又一次卷到起飞
7月26日,新一代AI Agent开发平台扣子(Coze)宣布开源零代码开发平台(Coze Studio)和调试工具扣子罗盘(Coze Loop)。二者结合已开源的Eino框架,为开发者提供全栈可用、可复用的开发工具,还采用宽松的Apache 2.0协议。
入选 SOSP'25:百度智能云对象存储的分布式层级 Namespace 破解业界难题,彻底扫清 AI 时代大数据上云障碍
百度沧海・存储团队与高校合作的论文被 SOSP'25 录用,介绍了百度智能云对象存储 BOS 的分布式层级 Namespace 系统 Mantle。它攻克业界难题,融合文件和对象存储优势,性能卓越,已在 BOS 生产环境大规模上线超两年。