模型不可知」共找到 8467 篇相关文章

产品应用7

Qwen深度研究一夜升级!可生成网页和音频播客,新模型能认医生手写体

Qwen版深度研究加速进化,增加听觉和视觉输出,可生成网页和音频。改进功能同时更新模型,Qwen3 VL能识别医生手写体。实测新功能表现出色,Qwen3-VL系列更新后性能优异。

量子位
产品应用8

预算有限、技术空白:最刁钻的AI用户,是中小企业老板

2026年大模型在中小企业办公环境中应用佳,工具与场景脱节。华为云推出专为中小企业的Flexus AI智能体平台,它依托自研模型,在多场景准确率领先,已在多行业验证效果,还能辅助内容创作。

InfoQ
开源动态8

QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5

通义文档智能团队推出QwenLong - L1.5,提供长文本推理后训练“配方”,含数据合成管线、强化学习方法和智能体架构。通过三大“法宝”重塑模型能力,效果显著,相关代码已开源。

AINLPer
开源动态8

腾讯祭出开源核弹!LeVo音乐生成模型,媲美Suno,支持零样本风格迁移,歌词完美匹配

音乐生成领域有重大突破,腾讯AI Lab开源高保真音乐生成模型LeVo。它由LeLM和音乐编解码器组成,能解决现有方法在音质、音乐性等方面的局限,实验显示其优于现有方法,功能强大且适用场景多。

开源星探
算法论文8

让机器人「仅会想,还能准确去做」,VLA-R1把「推理+行动」带进真实世界

VLA-R1是“先推理、后执行”的VLA基础模型,结合链式思维监督与强化学习,优化推理和执行。它有两阶段训练、三类可验证奖励等创新点,经多层面测试效果好,在多领域有应用前景。

机器之心
新闻资讯7

Anthropic 联创曝内部工程师已写代码了,但工作量翻倍!开发者嘲讽:所以 Claude bug才那么多?

Anthropic联合创始人透露公司工程师已写代码,通过管理AI Agent系统写代码,工作量达原来2 - 3倍,还提议向AI公司征税。但开发者质疑Claude存在诸多问题,认为AI写代码未到革命地步。

AI前线
开源动态8

LLaVA-OneVision-1.5全流程开源,8B模型预训练只需4天、1.6万美元

灵感实验室团队联合 LMMs - Lab 推出 LLaVA - OneVision - 1.5,全流程开源。其 8B 模型预训练 4 天、成本 1.6 万美元,在多模态基准上性能优,还公开数据构建与训练策略等细节,复现简单。

机器之心
开源动态8

告别大模型“失忆”!人大开源MemSifter:轻量代理先思考再回忆,搞定长时记忆

中国人民大学团队提出全新LLM记忆管理框架MemSifter,打破长时记忆管理‘精度够’和‘成本太高’的困局。它将记忆检索‘外包’给轻量级代理模型,采用任务结果导向的RL训练范式,在8个基准测试中超越现有SOTA方案。

深度学习自然语言处理
产品应用8

别再纠结选哪个模型了,这个项目让它们一起干活!豪赠1亿token,羊毛薅起来!

元脑企智 EPAI 推出「多模融合」API,让多个模型围绕同一任务协同工作。经代码生成、财务分析等测试及权威评测,效果出色。还采取智能调度等策略,现限时申请可免费使用,豪赠1亿token。

GitHubStore
开源动态9

7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开

北京中关村学院7名跨专业博士生,耗时3个月从零训练出7B参数大模型ZGCM-1,采用数百个Agent协作实践AI4AI研发范式,全程公开代码、数据、权重、训练日志,分享一线实战经验。

量子位