「联邦学习算法」共找到 1822 篇相关文章
新“SOTA”推理模型避战Qwen和R1?欧版OpenAI被喷麻了
“欧洲的OpenAI”Mistral AI发布首款推理模型Magistral,却再遭质疑未与最新版Qwen和DeepSeek R1对比。该模型亮点是支持多语言推理,以纯RL方式训练,为LLM强化学习提供新范式。
英伟达发现RL Scaling!创造力暴涨,做基座模型做不了的事!
过去学界争论强化学习(RL)对语言模型的作用,此前研究认为其效果有限。本文发现问题出在训练时间短,提出ProRL,让训练突破2000步以上,结果惊人,小模型也能有出色表现。
微软等提出「模型链」新范式,与Transformer性能相当,扩展性灵活性更好
随着大语言模型发展,扩展 Transformer 架构成趋势,但参数规模增长带来训练负担。微软等研究者提出 CoR 概念,构建模型链学习范式,应用于语言模型得 CoLM 系列,实验显示其性能相当且扩展性、灵活性更好。
Anthropic CEO:人的幻觉比AI 更多!这是真的吗?
Anthropic公司CEO称AI幻觉比人类少,创业公司ColdIQ联合创始人Alex Vacca用虚构故事喂给ChatGPT、Claude和Gemini,测试它们识破谎言的能力,实验结果显示各模型表现不同,AI幻觉短期内难消失。
一文讲透程序编排的核心方式:从表达式语言到并行化实践
文章围绕程序编排展开,介绍单语句编排、类编排、流程编排、并行化编排等核心方式,分析多种编排框架特点及适用场景,还提及Lindorm泛时序数据解决方案,为开发者提供编排参考。
智能投顾的大模型应用,为什么选择了“大小模型协同”?
大模型时代,金融智能投顾落地是技术与业务安全的双重挑战。北银金科高级算法专家尹辰轩表示采用“大小模型协同”架构,能在性能、准确性与合规间找平衡,还阐述了架构亮点、问题解决办法等。
人类打辩论不如GPT-4?!Nature子刊:900人实战演练,AI胜率64.4%,还更会说服人
瑞士洛桑联邦理工学院等机构研究人员让900名美国参与者与人类或GPT - 4就社会议题辩论。发现GPT - 4知晓对手信息时胜率64.4%,说服效果提升81.2%,低/中争议话题更易受其影响。
一场对话,我们细扒了下文心大模型背后的技术
信通院大模型推理能力评估中,文心X1 Turbo获最高级“4+级”。百度AI Day上,副总裁吴甜解析文心4.5 Turbo和文心X1 Turbo,从多模态、深度思考等方面介绍技术,还展示其在多场景应用成果。
从 VLM 到 VLA,智驾距离跨过「L2.9999」还有多远?
2025 年上半年,国内智驾安全受关注,浮夸宣传行不通。文章探讨厂商智驾宣传卡「L2.9999」玄机、端到端成主流原因等,分析了 L2 与 L3 区别及事故责任界定,还提及车企应对策略。
1.7K star!找到啦,小众需求,但是需求的时候你一定用得上,企业级能源管理神器
MyEMS是开源能源管理系统新标杆,基于Python+Django构建,提供完整解决方案。支持多场景能耗监控,通过可视化报表和AI算法优化能效,助企业降15%-30%能源成本,还介绍了其功能、架构等。