「训练成本」共找到 3393 篇相关文章
高保真、多控制集成于「统一画布」,组合式图像生成新范式!
Canvas - to - Image是新型图像生成框架,将多种控制方式整合到统一画布,用户可直观操作生成高保真、多控制图像。它简化创作流程,解决了现有方法控制单一分散、交互性差的问题。
上下文工程的精髓在于删除?
Hugging Face工程师Philipp Schmid整理分享,Manus团队重写五次代理系统,发现删代码比加功能好。AI模型存在‘上下文腐败’问题,Manus给出清理上下文、避免共享大脑、精简工具等解决办法。
田渊栋离职Meta,最后一篇论文?
离职Meta后,田渊栋团队论文被NeurIPS 2025录用。研究提出「三门理论」,发现RLVR微调在小权重发力,不破坏模型结构,还绘制出RLVR训练动态的「参数层面全景图」。
少量视角也能得到完整3D几何,即插即用的语义增强重建插件来了
现有神经隐式路线在样本稀疏时有跨视角对应不稳等问题。上海交通大学等团队提出SERES,将跨视角语义一致性作先验注入模型,以低成本解决歧义问题,在多场景提升重建质量。
2025甲子Cool Vendor人形机器人大模型领域报告 | 甲子光年智库
甲子光年智库发布《2025甲子cool vendor人形机器人大模型领域报告》。当前人形机器人产业迎来关键转折点,产业链层级完整,大模型解决落地难题,应用场景升级。报告还呈现了产业链现状与趋势。
刚刚,全球首个GB300巨兽救场!一年烧光70亿,OpenAI内斗GPU惨烈
为争夺有限GPU,OpenAI内部争斗激烈,2024年算力投入70亿美元仍不够。微软发布全球首台GB300超算专供OpenAI,可让万亿LLM数天训完。OpenAI建立资源分配机制应对挑战。
【实测&解读】全球首个手机通用Agent——AutoGLM 2.0发布!我喝到了AI为我点的第一杯咖啡~
智谱更新的AutoGLM 2.0是全球首个手机通用Agent,适配苹果和安卓手机,无需交出手机使用权。它配备云手机和云电脑,由GLM - 4.5和GLM - 4.5V驱动,能完成点咖啡等多场景任务,因风险控制付款需人确认。
云计算一哥首度牵手OpenAI,大模型「选择」自由,才是终极胜利
亚马逊云科技宣布通过两大平台支持OpenAI新开源模型,还上线Anthropic最新模型Claude Opus 4.1。其早有战略布局,两大平台汇聚400+模型,践行‘选择大于一切’理念,满足多样需求,打造AI生态。
震撼,世界模型第一次超真实地模拟了真实世界:谷歌Genie 3昨晚抢了OpenAI风头
昨晚谷歌DeepMind宣布Genie世界模型到第3代,能通过单个文本提示词创建交互式、可玩环境。它在多方面优于前代及其他模型,具备构建完整世界能力,但也存在动作空间有限等局限,未来应用值得期待。
清华-腾讯联手:音频 - 视觉多模态任务统一框架
Crab是人大、清华和腾讯合作论文提出的模型,目标是高效一统多模态场景理解任务。它解决了音频 - 视觉理解模型任务干扰、合作显式化不足等难点,通过构建数据集、设计结构和统一架构实现多任务合作。