学习能力」共找到 4239 篇相关文章

新闻资讯8

Claude Opus 4.7发布!这是你在别的公众号看不到的五个发现

Anthropic发布Claude Opus 4.7,编码和视觉能力提升,但长上下文能力下降。其231页的System Card藏着不少有趣发现,如Opus 4.7非最强模型、Claude知道被测试、模型审查自身评估等。

花叔
产品应用7

真·养虾!3步让龙虾边聊边进化,不用GPU不用数据集就能强化学习

程序员给智能体套在线强化学习系统MetaClaw,把用户与AI对话变训练数据。它基于Kimi - 2.5,用SkillRL框架,不依赖本地GPU,训练交Tinker云平台,三步即可上手。

量子位
算法论文7

POF|清华大学张宇飞团队:采用数据驱动湍流模型的三维增升装置模拟

传统RANS方法预测分离流动有挑战,数据驱动湍流模型泛化性能有局限。清华大学张宇飞团队研究其在复杂三维增升装置应用,验证SST - CND模型泛化能力及修正项迁移能力,证明其可用于真实工程流动问题。

力学与人工智能
推荐文章8

拿到DeepMind、Meta等多家Offer后,她把机器学习求职面试的真相写了出来

牛津大学博士生Silvia Sapora把机器学习求职面试经历原原本本写在博客中。她分享面试准备技巧、心态与谈判策略,提醒一次面试表现不定义研究者价值,该文对求职者或许比题库更有用。

机器之心
开源动态7

OpenAI没做到,DeepSeek搞定了!开源引爆推理革命

文章围绕大语言模型推理能力展开,介绍了推理模型概念,回顾RLHF训练流程,对比OpenAI的PPO和DeepSeek的GRPO,还阐述了GRPO开源升级版DAPO的关键技术点及训练中模型的新能力

新智元
新闻资讯8

刚刚,GPT-5.4 发布,百万上下文、最强全能模型

OpenAI发布GPT - 5.4,集推理、编程等能力于一体,支持百万级上下文窗口。有三个版本,功能全面升级,如支持中途打断、电脑操作、视觉能力提升等,还更省token、少幻觉,安全机制完善,价格有调整。

AGI Hunt
新闻资讯7

每周产业洞察 | AI音视频模型能力全面嵌入“专业级视听内容”交付,对齐“制作级”

北京AIGC视听产业创新中心位于朝阳区,是朝阳区推动影视制作基地建设举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚近百家合作伙伴。首创郎园拓展服务能力,项目多地开花。

郎园Station
新闻资讯7

4o-mini华人领队也离职了,这次不怪小扎

OpenAI的Kevin Lu离职,下一站是估值120亿美元的Thinking Machine Lab。他毕业于UC伯克利,在OpenAI领导完成4o - mini,擅长小模型和强化学习。他认为应关注互联网数据,停止强化学习研究转做产品开发。

量子位
算法论文8

上海AI Lab、浙大EagleLab等提出RRVF:利用「验证非对称性」,只输入图片学习视觉推理

上海AI Lab、浙大EagleLab等联合完成研究,提出RRVF框架,利用「验证非对称性」,仅输入图片学习视觉推理。它构建闭环系统,通过迭代推理、视觉反馈等步骤训练模型,实验显示效果佳,证明验证法则力量。

机器之心
新闻资讯8

Anthropic史诗级泄密!全新模型意外曝光:能力碾压Opus 4.6,因太危险被限制发布

Anthropic重大泄密,全新模型“克劳德神话”(Claude Mythos)及Capybara层级曝光。新模型性能超Claude Opus 4.6,但因网络安全隐患大未全面发布,首批仅给安全机构。泄密源于配置失误。

AI寒武纪