大模型3.0」共找到 9992 篇相关文章

算法论文8

ACL'25最佳论文解读 | 模型也会‘弹簧回弹’?揭秘 LLM 对齐的脆弱根源

本文分享 ACL 2025 最佳论文,指出预训练模型存在‘抗对齐’的 Elasticity 现象,即对齐微调只是暂时拉伸,后续微调会让其迅速弹回预训练分布。研究量化该概念,用‘压缩理论’刻画对齐并实验验证。

PaperAgent
开源动态8

开源!强效果,高性能,严隐私?我全都要:OPPO 终端模型实践

OPPO AI 中心推出开源端侧多模态模型 AndesVL,含 0.6B - 4B 四档尺寸套件,有通用能力强等优势。它经多阶段训练,OPPO 还构建端侧部署方案,评测显示其在多方面表现优异,未来会继续技术革新。

InfoQ
开源动态8

告别模型“失忆”!人开源MemSifter:轻量代理先思考再回忆,搞定长时记忆

当前语言模型在长周期任务中,长时持久记忆管理陷入“精度不够”和“成本太高”的两难困境。中国人民学团队提出MemSifter框架,将记忆检索工作外包给轻量级代理模型,在8个权威测试中超越现有方案,且已开源。

PaperAgent
新闻资讯7

模型一年内就会吞噬 Harness!Google AI Studio负责人:深耕垂直领域才是创业公司唯一生路

Google AI Studio负责人Logan认为,模型一年内将吞噬Harness,90%的Agent中间件公司最多存活12个月。创业公司应深耕垂直领域,Google用Anti - Gravity平台串联产品,推动智能体发展,且模型后训练潜力巨

AI科技大本营
7

Claude用户退订潮!被指高峰期偷换缩水模型,工程师列9罪状呼吁全网退订

Claude出现危机,AI工程师带头呼吁退订,列9罪状,如高峰时段偷换缩水模型等。不少用户退订,转投OpenAI Codex,其使用量激增。这也让国产模型等获更多尝试,CLI AI编程模式受重视。

量子位
算法论文8

别再用单选评测骗自己了!Amazon新论文揭示了模型在多选题中的3种系统性偏差

Amazon新论文揭示模型做多选题有3种系统性偏差,如选择、数量、猜测偏差。还推出SATA - Bench评测,给出10个测量指标,提出Choice Funnel解码策略,能提升小模型多选题正确率。

深度学习自然语言处理
开源动态8

全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源科学多模态模型Intern-S1。它融合多学科知识,首创跨模态科学解析引擎,在多学科任务上超越顶尖闭源模型,还支撑构建了多智能体系统。

机器之心
产品应用8

刚刚,Qwen3.8-Flash震撼发布,我们看到了Qwen4的骨架

8月模型厂商多上调API价格或收缩免费额度,因推理需求增长跑赢算力供给。阿里发布Qwen3.8-Flash并开源,成绩亮眼且价格低。它是Qwen4架构预演,有四技术创新,提升了模型效率。

机器之心
新闻资讯7

独家|RoboScience 机器科学完成10亿元融资,资金将用于强化 VLOA 模型与本体

AI科技评论独家消息,RoboScience机器科学近日完成10亿元A轮融资,将深化VLOA模型技术,推进自研机器人本体工程化与量产。其VLOA模型有创新性架构,能实现通用泛化,还将发布自研机器人本体。

AI科技评论
开源动态8

国产AI视频炸了!SkyReels-V3三功能重磅开源,1张图生成逼真视频

昆仑天工SkyworkAI团队开源多模态视频生成模型SkyReels-V3,它能在一个架构内搞定参考图像转视频、视频延长、音频驱动虚拟形象三核心能力,超越主流商业模型,且真正开源。

新智元