全模态推理」共找到 3724 篇相关文章

推荐文章7

新手必看!强化学习入门指南 | 从RLHF、PPO、GRPO到RLVR,最后到训练推理模型

Unsloth团队发布强化学习教程,从吃豆人谈起,介绍RLHF、PPO、GRPO等概念,分享用GRPO训练推理模型技巧。涵盖强化学习基础知识,还给出Unsloth使用GRPO训练模型方法及奖励函数示例。

AINLPer
新闻资讯8

阿里安AGI一次发布3款LLM,8B多维度领先GPT-5.4

近期,阿里安AGI实验室发布3款Yuvion LLM,在AI安与内容安领域多维度领先。它以‘对抗即智能’为原则,构建五类数据体系,采用三阶段训练范式,通过YLRE四级评测体系验证能力。

PaperAgent
开源动态8

刚刚,Kimi开源新架构,开始押注线性注意力

智能体时代推理计算需求成瓶颈,线性注意力可降复杂度但表达有限。月之暗面开源 Kimi Linear 新架构,结合线性与注意力,性能和硬件效率出色,引发对线性与注意力发展方向的思考。

机器之心
算法论文8

Thinking Machines新发现:Lora不是权宜之计,哪怕秩低到 1,也能匹敌参数微调

Thinking Machines和John Schulman新研究刷新对LoRA的认知,实验显示正确使用时它能匹敌量微调。团队系统研究训练集与参数关系,有层选择、学习率等关键发现,还给出实用建议,但LoRA在部分场景表现待验证。

AI工程化
算法论文8

模型合体!上交&上海AI Lab&华师提出LED-Merging,拒绝「能力」与「安」二选一

上海人工智能实验室等团队提出LED - Merging解决模型融合“安 - 效用冲突”问题。该方法无需训练,像“神经元手术刀”,不牺牲专业能力还提升安性,论文已被ACL 2025 Main Conference接收。

深度学习自然语言处理
产品应用8

用DAA衡量智能体 百度智能云用“新栈”重新定义AI云|甲子光年

2026年产业焦点转向智能体落地,李彦宏提出DAA概念。百度智能云升级为新栈AI云,解决智能体落地难题,从架构决策、行业应用等多方面发力,其价值值得市场重估。

甲子光年
开源动态8

性能比肩DeepSeek-R1,MiniMax仅花380万训出推理大模型性价比新王|开源

MiniMax开源推理大模型MiniMax - M1,原生支持100万token输入、8万输出,性能比肩DeepSeek - R1,仅花380万训成。采用Lightning Attention机制与CISPO算法,在多领域表现出色,模型权重可在HuggingFace下载。

量子位
产品应用7

说实话提前拿到Qwen3.7-Max内测,最让我意外的不是它推理变强了!

作者提前2天拿到Qwen3.7-Max内测,经测试,该版本补齐短板,综合能力强。审美提升明显,代码质量不错,长程思考推理迭代能力佳,适合替换到部分工具里。

探索AGI
产品应用8

单张显卡跑出15倍推理速度,aiX-apply-4B小模型加速企业AI研发落地

3月25日,硅心科技发布专为代码变更应用场景设计的轻量级模型aiX - apply - 4B。该模型在准确率、推理速度等方面表现出色,超越部分千亿级大模型,还推出“大模型+小模型”协同架构释放企业算力价值。

量子位
新闻资讯7

文件被 Gemini 当场“格式化”,没了!网友控诉:Claude、Copilot 也爱删库,一个都跑不了

开发者 anuraag2601 用 Gemini CLI 做文件管理测试时,Gemini 操作失败致文件丢,事后不断道歉。网友也反映 Claude、Copilot 等有类似删库问题,这或是模型训练导向问题。

InfoQ