渐进式训练」共找到 2691 篇相关文章

算法论文8

CJA | 北航罗明强教授团队:一种基于生成人工智能的快速结构化飞行器概念设计方法

目前人工智能为飞机概念设计提供方案,但存在数据需求大等问题。北航罗明强教授团队提出基于LLMs的设计方案生成方法,开发原型系统,实验表明LLMS有相当设计能力,该方法可降成本、提效率。

力学与人工智能
开源动态8

突破视觉仿真算力瓶颈!新一代具身智能仿真框架开源:高吞吐并行高保真渲染助力规模化训练

具身人工智能向以视觉为中心转型,但面临“看得真”和“训得快”难题。清华大学智能产业研究院等提出GS - Playground通用多模态仿真框架,融合高吞吐量并行物理仿真与高保真视觉渲染,成果被RSS 2026录用,将开源。

量子位
算法论文8

大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练

字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。

量子位
新闻资讯7

硅谷开启预防裁员!AI还没替代,先裁50%做准备,股价还能大涨17%

推特创始人杰克·多西领导的Block一次性裁掉近半员工,约4000多人。理由是预见AI强替代性,小团队更高效。此决策获市场积极反馈,股价涨17%,后续或有科技公司效仿。

量子位
产品应用7

Gemini 3 编程第一断崖领先,谷歌 AI Mode 直接装备 G3,反重力的 Antigravity 是啥?

今年 8 月发布的 GPT 5 未达成 AGI,Gemini 3 能力提升明显。谷歌将其塞进 Search 的 AI Mode,AI 普惠意义超能力升级。开发者方面,它是主力型号,编程能力跃升,还加强 Agent 能力并推出新工具 Antigravity。

MacTalk
算法论文8

超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破

文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。

机器之心
新闻资讯7

用户集体大逃亡!Cursor“自杀政策”致口碑崩塌:“补贴”换来的王座,正被反噬撕碎

很多开发者吐槽和弃用 Cursor,其付费后砍功能、技术变差、营销成“障眼法”,引发信任危机。部分用户转向 Claude Code,AI 编程工具竞争焦点升级,未来有向智能体演进等趋势。

InfoQ
新闻资讯7

用户集体大逃亡!Cursor“自杀政策”致口碑崩塌:“补贴”换来的王座,正被反噬撕碎

很多开发者吐槽并弃用 Cursor,因其付费后砍功能、技术变差、营销像‘障眼法’,引发信任危机。部分用户转向 Claude Code,不过企业侧使用情况有差异。AI 编程工具竞争激烈,需多维度构建优势,市场未来趋势明显。

AI前线
新闻资讯8

模型训练最重要的依然是 Scaling —— 对话阿里通义千问 Qwen 多语言负责人杨宝嵩 | Open AGI Forum

本文是对阿里通义千问Qwen多语言负责人杨宝嵩的专访。他透露Qwen一开始就将国际化视作核心战略,团队建立文化标注体系确保内容安全合规。还谈到多语言推理难题及应对策略,认为扩大模型规模和数据量仍重要,合成数据是延续Scaling Law的关键。

AI科技大本营
新闻资讯8

断腿也能跑!97小伙研发乐高机器人,每个模块独立自主,断臂后秒变三脚怪兽继续狂奔

近日,美国西北大学博士生余琛团队研发出全新模块化机器人,由独立智能腿模块组成,能像乐高自由组合,可在复杂户外奔跑,断腿后也能继续前进,在多领域有应用潜力,相关论文已发表。

DeepTech深科技