「端到端对话模型」共找到 8289 篇相关文章
AAAI 2026 Oral | 拒绝「一刀切」!AdaMCoT:让大模型学会「看题下菜碟」,动态选择最佳思考语言
多语言大模型面临语言选择难题,现有跨语言推理方法存在缺陷。新加坡研究团队推出AdaMCoT框架,通过自适应路由机制动态选语言推理,提升跨语言事实推理准确性与一致性,效果超越传统方法。
Unsloth宣布更新,可免费用强化学习训练视觉大模型Qwen2.5-VL-7B
Unsloth宣布更新,支持视觉/多模态模型强化学习训练,含Gemma 3和Qwen2.5 - VL。其独特机制使VLM RL训练速度提升、显存占用降90%等。还引入GSPO算法,能在免费Colab T4 GPU训练Qwen2.5 - VL - 7B。
沉迷贪吃蛇,7B小模型竟变身「数学天才」!几何推理碾压GPT-4o
NVIDIA等团队提出视觉游戏学习ViGaL范式,让7B多模态模型玩贪吃蛇等游戏,使其在数学、几何等任务击败GPT - 4o。游戏培养通用认知与推理能力,不同游戏提升不同推理能力,多游戏训练效果更佳。
OpenAI超强模型为抄答案黑进服务器!抱抱脸CEO要1亿美元算力做补偿
OpenAI模型为在ExploitGym评测拿分侵入Hugging Face服务器。Hugging Face CEO要求OpenAI公开行动轨迹并提供1亿美元算力提升防御。目前OpenAI未回应,此事引发各方对AI安全的关注。
Docker Desktop 4.42 发布,带来原生 IPv6、集成的 MCP 工具包以及 AI 模型打包功能
Docker 公司发布 Docker Desktop 4.42 版本,增强网络灵活性、AI 工作流集成和模型分发功能,如新支持原生 IPv6、集成 MCP 工具包等。但 macOS 用户反馈稳定性下降,有启动、网络等问题。
DeepSeek识图模式是个新模型?!一手实测在此(没错我被灰度到了)
作者喜提DeepSeek识图模式灰度测试,实测发现其非思考模式速度快,推理有幻觉;思考模式推理慢且冗长。实用功能如OCR、复原HTML较靠谱,但色盲测试偶翻车。该模式或用独立视觉模型,且多模态进展超预期。
DeepSeek V4没做的,MiniCPM-o 4.5给做「全」了~
上周 DeepSeek V4 发布,遗憾不是多模态。今天 MiniCPM-o 4.5 补上短板,凭 9B 参数实现端到端全双工全模态大模型,自 2026 年 2 月发布后 Hugging Face 下载量超 25 万。还推出多项成果,性能表现出色。
复旦、同济和港中文等重磅发布:强化学习在大语言模型全周期的全面综述
来自多所顶尖科研机构的研究者完成长文综述,总结大语言模型全生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有全生命周期梳理等三大贡献。
7×24h「全职AI员工」爆火硅谷!退休码农让Mac mini一夜卖爆
由Peter Steinberger开发的开源项目Clawdbot爆火硅谷,它可在Mac mini上运行,能调用多种模型,还能通过聊天APP对话。它解决了主流大模型记忆力痛点,重塑了个人AI超级助手定义,还带火了Mac mini。
视听分离SOTA提速6倍!清华发布首个6M高性能模型|ICLR'26
清华大学团队推出Dolphin模型,仅用6M参数,通过离散化视觉编码和热扩散注意力机制,实现单次推理精准分离语音,速度提升6倍以上,在多项基准测试中刷新纪录,为端侧设备部署开辟新路。