不对称训练」共找到 3307 篇相关文章

开源动态8

突破视觉仿真算力瓶颈!新一代具身智能仿真框架开源:高吞吐并行高保真渲染助力规模化训练

具身人工智能向以视觉为中心转型,但面临“看得真”和“训得快”难题。清华大学智能产业研究院等提出GS - Playground通用多模态仿真框架,融合高吞吐量并行物理仿真与高保真视觉渲染,成果被RSS 2026录用,将开源。

量子位
产品应用8

3个工程师、0融资、开会,估值3.5亿美元的Obsidian才是真正的「小而美」

Obsidian 作为全球最具影响力的本地化 Markdown 笔记应用之一,估值 3.5 亿美元,但仅 7 人全职团队。它拒绝资本,靠用户付费运营,有「无会议文化」,底层插件系统强大,和 Notion 信息管理哲学同。

机器之心
推荐文章7

完美解决Clawdbot巨额消耗,教你用国产模型实现7*24停机使用,成本降低10倍。

文章介绍Clawdbot玩法爆火,因名称被指控侵权改名moltbot。重点给出实操干货,解决连接和成本问题,推荐用MiniMax M2.1模型搭配,还介绍接入飞书方法及该模型5大优势。

开源AI项目落地
新闻资讯8

AGI只是硅谷的幻想?!AI科学家盛赞中国,并从物理学角度宣告我们永远造出AGI

AI科学家Tim Dettmers在博客文章中指出,计算须遵循物理定律,线性进步要指数级资源,硬件升级红利已尽。他认为美国追求AGI和超级智能切实际,中国重应用普及更务实,AGI难以实现。

AIGC开放社区
新闻资讯8

AGI只是硅谷的幻想?!AI科学家盛赞中国,并从物理学角度宣告我们永远造出AGI

AI科学家Tim Dettmers在博客发文指出,计算需遵循物理定律,线性进步要消耗指数级资源,硬件升级红利已尽。他认为美国追求超级智能短视危险,中国重应用普及更务实,AGI会发生,超级智能是幻想。

AIGC开放社区
算法论文8

超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破

文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。

机器之心
新闻资讯7

Claude 急了!模型降智,官方长文用 bug 搪塞?开发者怒怼“太晚了”:承认达标为何退钱?

8 - 9 月初Claude模型质量下降,Anthropic发文解释是因三项基础设施漏洞。介绍了三个bug及处理办法,也分析检测难的原因并给出改进方案,但很多用户已再买账,Claude用户流失问题持续。

AI前线
新闻资讯7

Claude 急了!模型降智,官方长文用 bug 搪塞?开发者怒怼“太晚了”:承认达标为何退钱?

8月至9月,Claude模型质量下降,Anthropic将问题归咎于三项基础设施漏洞。开发者满,质疑官方用bug搪塞,要求退款。官方虽剖析问题并提出改进方案,但很多用户已再买账,Claude用户流失问题持续数月。

InfoQ
算法论文8

AI"学霸"也解出高中题?耶鲁、复旦发布MMSciBench,揭示AI理科推理能力短板

耶鲁、复旦等推出MMSciBench评测基准,揭示主流模型复杂科学推理短板。它有高质量数据、多模态多题型测试和精细知识分类体系。测试发现模型图文融合及推理能力弱,英文推理或效果更好。

深度学习自然语言处理
新闻资讯8

模型训练最重要的依然是 Scaling —— 对话阿里通义千问 Qwen 多语言负责人杨宝嵩 | Open AGI Forum

本文是对阿里通义千问Qwen多语言负责人杨宝嵩的专访。他透露Qwen一开始就将国际化视作核心战略,团队建立文化标注体系确保内容安全合规。还谈到多语言推理难题及应对策略,认为扩大模型规模和数据量仍重要,合成数据是延续Scaling Law的关键。

AI科技大本营