模型迭代」共找到 7939 篇相关文章

新闻资讯7

Sutton、OpenAI 联创押注的持续学习,有中国团队带着模型进场了

7 月,TML 发布 Inkling 模型,Mind Lab 发布 Macaron V1,二者均针对持续学习场景。持续学习走「参数空间的」路线,让模型用得越多越好用。硅谷已有不少新尝试,产业链正在形成。

Founder Park
开源动态8

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

Deep Cogito 是旧金山 AI 初创公司,开源四款混合推理模型。最大 671B MoE 模型性能超 DeepSeek v3 等,推理链比 DeepSeek R1 短 60%,训练成本不到 350 万美元。核心方法是蒸馏与增强。

机器之心
产品应用8

蛰伏一年,周衔团队带来首个具身基础模型,烹饪做实验弹琴,效果炸场

Genesis AI公布首个机器人基础模型GENE - 26.5,能完成烹饪、解魔方等复杂任务。该模型是全栈系统,以仿真加速,用自研手套采集数据,还重写控制栈。公司后续计划发布全身机器人。

机器之心
产品应用7

模型是万能的吗?探索机器学习+⼤模型在某出海投资业务的应⽤

本文基于公共云大客户出海投资业务案例,探讨用AI大模型结合机器学习算法构建投资预算预测与分配系统。历经三版方案,从纯大模型到引入机器学习算法,目前项目处于落地阶段,有望实现多方共赢。

阿里云开发者
产品应用8

Claude Code 推出 /Ultraplan,超级计划模型

Claude Code 推出 `/ultraplan` 功能,在写码前提供可视化方案,可编辑、审批。还发布了 Claude for Word 集成微软 Office 套件。Anthropic 快或因内部使用更强的 Mythos 模型

AGI Hunt
推荐文章8

从 ReAct 到 Ralph Loop:AI Agent 的持续范式

文章围绕AI Agent持续范式展开,指出AI编程助手现存过早退出等问题,介绍了Ralph Loop范式,阐述其核心要素、原理、优势,对比与传统智能体循环差异,还给出使用最佳实践、适用场景与建议。

阿里云开发者
新闻资讯7

Sam Altman 刚刚发文:Sora 2要高速,两大变革直指版权与搞钱

Sora 2因大量侵犯日本动漫 IP 遭日本高层施压。Sam Altman 宣布立即调整,一是赋予版权方更精细的角色生成控制权,二是尝试商业化并与版权方收入分成,还会高频,新方法将用于所有产品线。

AI寒武纪
开源动态8

小米的首机器人VLA大模型来了!丝滑赛德芙,推理延迟仅80ms丨全面开源

具身机器人成科技新热点,大家期待其释放生产力。小米首具身VLA大模型Xiaomi - Robotics - 0抓间歇停顿问题,4.7B参数规模下推理延迟仅80ms,还做三项技术创新,且全面开源。

量子位
推荐文章7

智能流体力学专题研讨会特邀报告3|边鑫:混合深度学习与方法的粘性不可压流动加速求解

2026年8月,第十四届全国流体力学学术会议在青岛举行,智能流体力学专题研讨会展示了人工智能与流体力学交叉领域进展。边鑫作《混合深度学习与方法的粘性不可压流动加速求解》报告,介绍HyDEA求解框架。

力学与人工智能
推荐文章8

120页深度报告,搞懂今年大模型和应用的现状与未来

Innovation Endeavors合伙人Davis Treybig发布《State of Foundation Models》(2025),从七个维度剖析AI产业现状与趋势。报告指出,AI发展迅速,模型成本高且快,应用渗透各行业,智能体崛起,市场结构变革,公司运作方式也在重塑。

Founder Park