「开源策略」共找到 3702 篇相关文章
16个月后Meta杀回开源,小扎力挺蒸馏
Meta发布新开放AI模型Muse Glimmer底层参数,未来几周将开放Muse Spark 1.2模型权重。扎克伯格力挺开源,称要为数十亿人提供免费强大AI,还为模型蒸馏辩护。Meta此举有现实压力,也想创造算力需求。
浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型
2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek - R1 - Safe基础大模型,提升了我国AI系统自主安全防控水平,任奎获“科研创新卓越贡献奖”。
LaPha:你的Agent轨迹其实嵌入在一个Poincaré球?
经典强化学习动作空间离散有限,但语言模型动作空间几乎无限。上海科学智能研究院联合复旦大学提出LaPha,将智能体行为树映射到潜空间,构造密集奖励、剪枝等,在基准测试中效果显著。
对话英韧科技刘刚:AI浪起,从芯到盘的存储马拉松与国产破局
2026年存储行业受AI驱动变革,存力成新“卡脖子”环节。英韧科技CEO刘刚在闪存峰会接受采访,谈及技术、市场与战略,展现企业在AI浪潮中的生存法则与战略取舍,如技术超前布局、“以模组促主控”等。
模型宣称的“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相
近年来大模型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开长上下文模型真实表现,测试顶尖模型发现长文本能力‘翻车’,还分析了长上下文难的原因及面临的瓶颈。
中国 AI 投资人:练习时长两年半
文章是对多家投资机构的访谈,探讨AI投资与创业趋势。涉及Manus成功经验、DeepSeek影响、模型公司前景、应用机会等,还谈及创业者应对策略、投资策略变化及行业未来思考。
如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程
丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及多方面实验。
“我不会被 AI 吞噬”!菲尔兹奖得主、scikit-learn 守护者与全球顶尖 AI 专家巴黎共话 AI Vision | GOSIM Paris 2026
2026年5月4日,GOSIM Paris 2026 AI Vision Forum在巴黎举行。菲尔兹奖得主、scikit - learn守护者等全球顶尖AI专家共话AI。全天议程涵盖智能体AI系统、AI教育应用等四大核心议题,强调面对AI浪潮,开放才能让人类居核心。
阿里“闪电战”再发力,这次是千问APP
阿里在AI领域影响力大,Qwen3-Max模型能力强,开源模型Qwen3-235B在Lmarena上开源第一。新发布的千问APP成Qwen模型第一入口,功能丰富免费,体验佳,是同类产品劲敌。
CVPR 2026 | 让AI视频不再「串戏」:免训练精准控制多段动作,SwitchCraft一招破解逻辑崩坏
随着文本到视频扩散模型发展,AI视频生成有进展,但开源模型处理多事件提示词时存在技术瓶颈。西湖大学团队提出免训练框架SwitchCraft,引入注意力控制机制,入选CVPR 2026,代码已开源。