多模型推理」共找到 9928 篇相关文章

开源动态8

性能大涨!阿里开源新版Qwen3模型,霸榜文本表征

今日凌晨阿里开源Qwen3-Embedding和Qwen3-Reranker两款新模型,专为文本表征等任务设计,支持119种语言。测试显示其性能出色,在语言文本表征和排序任务中超越众模型,还采用了种创新设计与训练方法。

AIGC开放社区
产品应用8

生产级Prompt自动化推理评估A/B实验结果的工程实践

本文围绕生产级Prompt自动化推理评估A/B实验结果展开,介绍系统背景与痛点,展示主Prompt和决策树,用deepseek - r1等模型推理。通过分析Bad Cases优化Prompt,总结设计原则和迭代方法,还给出通用启示与展望。

阿里云开发者
新闻资讯8

GAIR 2025 世界模型分论坛:从通用感知到视频、物理世界模型的百家争鸣

第八届GAIR全球人工智能与机器人大会世界模型分论坛上,五位青年学者围绕世界模型展开精彩演讲,话题涵盖通用感知、三维技术等。他们的研究为世界模型领域带来不同启发,目前该领域研究尚处起步阶段,共识未形成。

AI科技评论
开源动态8

刚刚,OpenAI 再次开源!安全分类模型 gpt-oss-safeguard 准确率超越 GPT-5

OpenAI 开源安全分类推理模型 gpt-oss-safeguard,有 120b 和 20b 参数量版本,采用 Apache 2.0 许可证。它能直接理解策略文档分类内容,推理能力超 GPT - 5,性价比高,虽有局限但仍是开发者利器。

AGI Hunt
开源动态7

开源模型叫板Nano Banana Pro!Stable Diffusion原班人马杀回来了

时隔一年,上一代AI生图顶流Flux带着新模型Flux.2杀回来了。该模型发布即开源,生图质量媲美谷歌Nano Banana,价格却便宜得。它有个版本可选,实测在指令遵循、精细控制方面有进步,但与Nano Banana Pro仍有差距。

量子位
开源动态8

NVIDIA发布最强开源模型,效果和速度全面超越DeepSeek R1

NVIDIA推出Llama - Nemotron系列开源模型,有LN - Nano、LN - Super、LN - Ultra三款。旗舰款LN - Ultra在权威测评中碾压DeepSeek - R1等,运行效率还更高。有“动态推理开关”功能,代码数据全公开,或引发AI推理效率革命。

深度学习自然语言处理
算法论文8

RLHF与RLVR全都要,陈丹琦团队最新力作将推理能力拓展到通用智能

普林斯顿大学陈丹琦团队发布学术成果,提出基于模型奖励思维的强化学习(RLMT)方法,弥合专门推理与通用对话能力差距,将链式思维优势扩展到更广泛范围,提升整体对话表现。

机器之心
新闻资讯8

刚刚,Thinking Machines Lab首次发长文,揭开LLM推理不确定性真相

Thinking Machines Lab发长文《克服LLM推理中的不确定性》,指出大语言模型推理不确定性的真正元凶是缺乏批次不变性,还解释核函数计算中数字加法顺序问题,介绍使核具有批次不变性的方法并给出实验结果。

机器之心
开源动态8

少 61% Token、10倍成功率,这个终端 AI 编程代理火了!

现在数AI编程工具问题,而在Github上火爆的`oh-my-pi`是运行在终端的AI编程代理,有哈希锚定编辑等实用功能,支持模型,经基准测试效果好,还能解决实际开发痛点。

开源先锋
算法论文8

英伟达、港大等发布创新KV缓存,实现扩散模型无训练加速

数开源扩散语言模型推理效率不如自回归模型,英伟达、港大、麻省理工研究人员联合提出Fast - dLLM。它用近似KV缓存机制减少冗余计算,还提出基于置信度的平行解码策略,测试显示能加速且保持生成质量。

AIGC开放社区