「开源精神」共找到 2996 篇相关文章
数据与舆情双引擎:DeepAnalyze + BettaFish
DeepAnalyze是面向自主数据科学的大语言模型,能自动完成数据科学任务,支持完整流程、开放式研究且完全开源。还提出两项关键技术。微舆 - BettaFish是舆情分析系统,四类智能体协同工作,有六大核心优势。
强化学习 AI 系统的设计实现及未来发展
本文是阿里巴巴算法专家曹宇在AICon 2025北京站的分享。从RLHF系统出发,结合实践展示RL系统现状与发展,探讨超大规模RL方向,涉及理论、业界实践、开源生态等,还介绍了AICon北京站活动。
数据蒸馏的双重突破:从几何保真到对抗鲁棒
深度学习中,数据集蒸馏可用精简合成样本替代庞大训练集且不牺牲模型性能,但面临精度和可靠性两大难题。两篇发表于 ICCV 2025 和 AAAI 2025 的论文分别给出解决方案,且代码已开源。
00后挑大梁!近20国选手激战外滩大会,AI科创赛三赛道冠军诞生
9月10日,2025外滩大会AI科创赛在上海落幕,设三大核心赛事,80个项目获奖。00后成主力,近20国选手参与。大赛提供资源支持,AI硬件赛受青睐,金融与安全赛道涌现创新方案,还开源数据集。
Kimi K2发布两天即“封神”?80%成本优势追平Claude 4、打趴“全球最强AI”,架构与DeepSeek相似!
国内独角兽月之暗面发布并开源 Kimi K2 模型,推出两天就在 OpenRouter 平台 token 使用量超 xAI 的 Grok 4。它成本低、性能强,编码能力追平 Claude 4,架构与 DeepSeek 相似,技术研究也多次‘撞车’。
10个小模型并联跑赢GPT-4.1!无额外训练,方法仅4步
上海人工智能实验室等机构提出Avengers框架,无需额外训练,通过四步集结小模型优势。实验表明,其在15个数据集上平均得分超GPT - 4.1,还探究了框架有效的要素,对AI研究和开源社区意义重大。
给GUI Agent装上「世界模型」:阿里通义用混合数据+统一思维链,让模型学会预判屏幕变化
伴随多模态大模型发展,GUI Agent成人机交互新范式,但构建高可用、跨平台的GUI Agent面临诸多挑战。阿里通义实验室开源Mobile - Agent - v3.5框架及GUI - Owl - 1.5模型家族,解决了相关技术壁垒。
机器人看不清,蚂蚁给治好了
天下苦机器人看不清透明和反光物体久矣,问题出在深度相机。蚂蚁集团具身智能公司蚂蚁灵波开源深度视觉模型LingBot - Depth,无需换硬件,用创新算法和大量数据提升性能,还将开源数据集。
数学推理热潮下的冷思考!如何训练真正"全能"的推理模型?
论文评估20余个开源推理模型在多领域表现,发现多数模型数学成功难迁移。揭示微调方法(RL vs SFT)决定能力泛化,SFT像‘填鸭’,RL似‘思维健身’,为构建通用推理智能体提供新路径。
伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开
开源软件工程模型DeepSWE横空出世,基于Qwen3 - 32B,仅用强化学习训练,以59%准确率刷新SOTA。它采用rLLM框架、R2E - Gym环境,用改良GRPO++算法,还介绍了评估策略及训练挑战的解决办法。