「大厂AI」共找到 12116 篇相关文章
100 页 Agentic RL 综述!牛津、新国立、AI Lab 等联合定义 LLM 下半场
2025 年大语言模型热潮持续,但当前主流训练范式显瓶颈。牛津、新国立等 16 家机构学者发布 100 页 Agentic RL 综述,明确定义从‘会说’到‘会做’进化路径,剖析理论、结构与实践,展望未来挑战。
颜水成领衔,给AI分段位!超100款多模态模型,无人达到L5
十所顶尖高校联合发布General - Level评估框架和General - Bench基准数据集,用五级分类制明确多模态通才模型能力标准。评估超100款模型,发现多数在L2 - L3,无L5模型,揭示当前模型不足。
马斯克翻车了!一边告OpenAI,一边偷偷蒸馏ChatGPT
4月30日,加州奥克兰联邦法院,马斯克诉OpenAI案进入第四天。马斯克承认自家Grok模型部分蒸馏了ChatGPT,还为AI公司排名,xAI垫底。法官拦下讨论AI灭绝话题,下周OpenAI联合创始人将出庭。
OpenClaw之父爆猛料:Meta和OpenAI跪着抢人,小扎亲自求收购
OpenClaw之父Peter Steinberger做客播客,爆出Meta与OpenAI收购争夺内幕。他用一小时做出原型,打造出能自我修改源码的AI智能体,宣称AI智能体将消灭80%的App,编程会沦为「织毛衣」。
从自己出题到自己选题:耶鲁新方法让大模型 Self-Evolution 又进一步
本文解读了耶鲁、斯坦福等多机构联合提出的INFUSER大模型自进化新方法,针对现有方法仅以难度筛选训练数据的缺陷,提出用影响力分数筛选高价值训练题,实现双模型协同动态进化,实验验证效果显著。
英伟达All in的物理AI路线,居然是中国黑马提前一年就定义好了
全球具身智能行业为技术路线争论时,中国深度机智率先提出并跑通「人类学习」路线,以人类数据为起点、动作建模为中心、机器人为AI而生,英伟达等跟进,深度机智全栈落地且进度领先。
Harness不是目的,知识才是护城河 —— 一个AI工程交付团队的知识沉淀实践
本文指出构建Harness工作流非最终目的,私域和团队知识沉淀才是技术护城河。分享AI Team工程交付编排系统中知识分层架构设计、团队知识库共建共享、工作流成知识沉淀载体、突破人机交互瓶颈及落地经验与思考。
Anthropic最强网络攻防大模型Mythos,美国国安局早就一直在用了
美国政府准备向多个联邦机构开放Anthropic新模型Mythos的‘修改版’,虽国防部将Anthropic拉黑,但国安局一直在用Mythos。白宫先明确模型接入的权限、用途等边界,再推进接入,各方对其态度有分歧。
人多不管用!智能体团队别盲目扩张,最新综述给出三大维度
随着大语言模型驱动的多智能体系统快速发展,核心问题是有些系统规模扩大后会失稳、低效。美国、英国和澳大利亚研究人员提出三维分类框架描述大规模智能体网络,指出真正决定系统表现的是三种机制组合。
低调霸榜全球最难SQL榜单超两月,国产AI这次选择高调开源!
蚂蚁数科低调霸榜全球最权威SQL榜单超两月后高调开源Agentar - SQL系列。其核心思想是让AI赋能生产,在金融场景验证后能力外溢到多领域,还采用按效果付费模式,展现强大竞争力。