学习迭代」共找到 1894 篇相关文章

新闻资讯8

刚刚,OpenAI 发布了GPT-5 前菜:ChatGPT Agent

OpenAI发布ChatGPT Agent,它是统一智能理系统,融合多种功能与工具,能动态选处理路径。在多测试中表现佳,采用强化学习微调新架构。使用体验似与人协作,OpenAI采取安全措施,还探索商业、分批开放,业内看法不一。

AGI Hunt
新闻资讯7

「流匹配」成ICML 2025超热门主题!网友:都说了学物理的不准转计算机

第42届国际机器学习大会(ICML)2025年7月将在加拿大举行,生成式AI前沿热点转向高质量、稳定、简洁、通用模型形态,流匹配技术踩中热点。它源于流体力学,能将噪声转化为数据,与扩散模型有紧密联系。

机器之心
推荐文章7

InfoQ 2025 年趋势报告:文化与方法

InfoQ 2025 年趋势报告指出,AI 虽提升开发速度,但带来质量问题,需新测试方法;团队协作重要,工程师依赖 AI 或破坏协作;初级工程师价值仍在,可借 AI 学习;可观测性成本攀升,应视为战略投资;平台工程是未来方向。

InfoQ
新闻资讯7

顶模 Fable 5.1发布,到底强了多少?

昨晚,Anthropic发布Fable 5.1和Mythos 5.1,这沿用Fable 5参数,性能提升聚焦长任务,还降低缓存读取价。它在游戏、视频等多个领域表现出色,与同类模型对比进步明显,虽价格贵,但能力、速度有提升。

鲸选AI
新闻资讯7

AI 设计9个月就能媲美Blackwell?OpenAI “辣芯”绕开英伟达正面战场,但老黄的GPU大盘不稳了

OpenAI 展示与博通联合打造的定制 AI 芯片 Jalapeño,性能媲美英伟达 Blackwell 或谷歌 TPU。计划年底部署,是多芯片开发首步。它专为大模型推理设计,设计周期短,成本低,OpenAI 借此扩展全栈能力。

InfoQ
新闻资讯8

Kubernetes v1.36 发布:安全默认配置强化,AI 工作负载支持日趋成熟

Kubernetes发布1.36版本,号Haru,含70项增强功能。聚焦安全加固、AI和机器学习工作负载及API可扩展性。如用户命名空间等安全功能达GA,AI方面适配工作负载需求,还引入新功能,同时移除部分旧功能。

InfoQ
算法论文8

具身智能奇点已至!超越π*0.6,极佳视界自我进化VLA大模型拿下世界第一

极佳视界具身大模型 GigaBrain-0.5M*依托世界模型实现自我进化,在多真实任务近 100% 成功,超 π*0.6 成 SOTA。其提出基于世界模型的强化学习范式,用超万小时数据训练,推动通用具身智能发展。

新智元
新闻资讯8

Anthropic刚发布了一份「AI抢饭碗报告」:学历越高越「被抢」

Anthropic《经济指数报告》揭示,任务越复杂AI加速越猛,学历高的工作受影响大。还指出人机协作能大幅提升任务时长,不同国家AI应用有贫富和技术差,也提到了‘去技能化’问题及对生产率的预测。

新智元
算法论文8

大模型如何泛化出多智能体推理能力?清华提出策略游戏自博弈方案MARSHAL

近日,清华大学等机构研究团队提出 MARSHAL 框架,利用强化学习让大模型在策略游戏自博弈。实验表明,多轮、多智能体训练提升了模型博弈决策水平,将推理能力泛化到通用多智能体系统,在一般推理任务表现显著提升。

机器之心
产品应用8

刚刚,蝉联Future X全球榜首的MiroMind发布全球最强搜索智能体模型

由陈天桥和季峰联合发起的 MiroMind 团队,于 1 月 5 日发布自研旗舰搜索智能体模型 MiroThinker 1.5。该模型参数规模小但性能强,其核心是「发现式智能」理念,还采用了新训练技术,有 A 股涨停板预测等应用。

机器之心