「多语言模型」共找到 9914 篇相关文章

算法论文8

面向「空天具身智能」,北航团队提出星座规划新基准丨NeurIPS'25

卫星星座成数字经济时代基础设施,但运行背后规划难题待解。北航刘偲教授团队提出首个大规模真实星座调度基准AEOS - Bench,训练内嵌时间约束的调度模型AEOS - Former,为‘AI星座规划’奠定新技术基准。

量子位
产品应用8

刚刚,全球AI生图新王诞生!腾讯混元图像3.0登顶了

LMArena竞技场发布文生图榜单,腾讯混元图像3.0夺冠,超越谷歌、字节和OpenAI等模型。它是原生多模态模型,语义理解强,核心技术独特,经多阶段训练,效果能与顶尖模型媲美。

量子位
产品应用7

如何让AI写出高质量的数据分析报告?DataV-Note的评估体系揭秘

本文围绕DataV - Note智能分析创作平台评估体系建设展开,指出智能工具缺乏统一评估标准等问题。介绍评估模型目标、设计、标准,采用纵向和横向评估方式,还提及未来接入自动化和提升准确度的规划。

阿里云开发者
算法论文8

李飞飞团队新作:简单调整生成顺序,大幅提升像素级图像生成质量

长期以来,AI生图面临潜空间模型细节损耗、像素空间模型结构混乱速度慢的矛盾。李飞飞团队最新论文提出Latent Forcing方法,通过重排生成轨迹,让像素扩散模型找回效率并刷新SOTA。

量子位
新闻资讯8

Jeff Dean:一年内 AI 将取代初级工程师,网友:“Altman 只会画饼,Jeff 说的话才致命”

谷歌传奇工程师 Jeff Dean 在访谈中预测,一年内将有具备‘初级工程师’能力的 AI 系统。他还谈到 AI 发展方向、智能体潜力、大模型格局等,也提及硬件重要性及 AI 在科研领域的影响。

AI前线
开源动态7

11 万 Star 的开源项目,给 AI 编码代理补流程,这套 Superpowers 值得装

110多K Star的开源项目Superpowers,是完整软件开发工作流程,基于17个可组合“技能”。它采用Pull模式,用苏格拉底式追问澄清需求,工作流覆盖多领域,支持多平台,一行命令即可安装。

AI进修生
算法论文8

CoT推理大溃败?哈佛华人揭秘:LLM一思考,立刻就「失智」

新研究揭示思维链CoT会分散模型「注意力」,使大模型推理时易出错。研究指出在需遵守指令任务中,用CoT推理模型准确率下降,还总结了四大模式,并提出四种缓解策略。

新智元
推荐文章7

从零开始200行python代码实现LLM

文章从传统思路实现诗词生成器入手,介绍了词汇表、Bigram模型等概念,接着用Python和PyTorch实现了真正的Bigram模型,阐述模型、训练等内容,最后回顾成果,下一篇将基于此实现完整GPT。

OpenMMLab
推荐文章9

梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

本文深度梳理了DeepSeek梁文锋过去三年署名的11篇AI核心论文,还原其从成本破局到Agent基础设施卡位的底层技术路线,拆解各论文核心突破,展现中国大模型差异化竞争路径。

AI科技评论
推荐文章7

从 GPT 到 Agent,技术与业务如何“双向奔赴”

InfoQ《极客有约》X AICon 直播栏目邀请徐文健、李陈忠、张昊阳探讨大模型产品落地路径。他们分享从 GPT 到 Agent 的经历、认知转变,讨论通用 Agent 及创业机会,还谈及 AI 产品难点和人才标准变化。

InfoQ