「多语言推理」共找到 6096 篇相关文章
Identity-GRPO:阿里开源多人物定制化视频生成的后训练优化算法
阿里团队提出Identity - GRPO算法解决多人物视频生成身份一致性问题。构建约15000个标注样本数据集,基于Qwen2.5VL设计奖励模型,多项策略增强训练稳定性,实验验证性能提升显著。
刚刚,北大&360里程碑式突破!32B安全分碾压千亿巨兽
2025年9月23日,北大 - 360联合实验室发布TinyR1 - 32B模型,仅用20k数据微调就实现安全性能突破,兼顾推理与通用能力。还推出TinyR1 - Safety - 8B,且系列模型已全面开源。
通义团队提出环境Scaling:自动构建环境,并自主学习和成长,可让30B比肩1T效果
阿里巴巴通义实验室团队论文提出通过程序化、自动化构建模拟环境,让语言模型自主交互学习。基于此训练的AgentScaler模型,数十亿参数就达万亿级模型性能,为轻量级代理智能发展带来新可能。
《“人工智能+”行动意见》深度解读:从人口红利到智能红利,中国经济社会变革新引擎
《“人工智能+”行动意见》是全面重塑中国经济、社会与治理体系的国家战略。它以应用促创新,定位AI为新质生产力关键引擎,涉及多领域变革,还采取不对称竞争策略,应对国际博弈。
DeepSeek“极你太美”bug,官方回应了
DeepSeek V3.1调用API开发时输出常现“极”字,在火山引擎、腾讯CodeBuddy等多平台出现,影响代码编译。官方称将在近版本修复,网友猜测或因数据清洗不彻底。
2025年多款Deep Research智能体框架全面对比
文章从 OpenAI 关于 DeepResearch 的指南入手,对多个开源深度研究智能体框架进行架构解构与功能对比,还体验了商业化智能体应用,为使用者和开发者选工具框架提供参考。
bootstrap 到十亿美元 ARR:Surge AI 这匹黑马如何颠覆 Scale 霸权 ?
Surge AI 成立于 2020 年,主创团队低调,短短几年业绩爆发。截至 2024 年 ARR 超 10 亿美元,超越 Scale AI。2025 年 7 月启动首次外部融资,其聚焦高质量数据标注,客户多为顶级科技公司。
AI「偷学」你的数据?6大顶级机构联手提出数据保护4大分级体系
生成式AI普及,数据保护成挑战。来自多机构研究者发布论文,提出全新数据保护分级体系,分为数据不可用、隐私保护、可溯源、可删除四级,还探讨了技术、法规及面临的挑战。
狂涨 9.5K star!!又一款轻量好用的web自动化项目,太爽了!!
介绍开源项目Nanobrowser,它是基于Chrome扩展的AI网页自动化工具,通过多智能体协作系统理解自然语言指令完成复杂网页任务,开源免费、保障隐私,有诸多实用功能,已获9.5K star。
首个全面梳理语音大模型发展脉络的权威综述,入选ACL 2025主会
香港中文大学团队语音语言模型综述论文《Recent Advances in Speech Language Models: A Survey》被 ACL 2025 主会议接收,这是该领域首个全面系统综述,指明语音 AI 未来方向,还剖析技术架构、训练策略等。