「双预训练架构」共找到 3645 篇相关文章
ICLR 2026 | 7B小模型干翻GPT-5?AdaResoner实现Agentic Vision的主动「视觉工具思考」
文章介绍了AdaResoner模型,它学会‘何时用工具’,在拼图推理上击败GPT - 5。Google为Gemini 3 Flash引入‘Agentic Vision’,与AdaResoner殊途同归。AdaResoner有独特训练方法,提升小模型性能。
【访谈对话】造过 Codex 的人,为什么每天用 Claude Code
Calvin French - Owen 曾参与构建 Codex,如今日常用 Claude Code。他与 Garry Tan 在 YC 播客对话,探讨了编程 Agent 产品哲学差异、分发逻辑、上下文工程等,还提及 Segment 重建、未来设想及安全等问题。
OpenAI推理第一人创业了:要造“活到老学到老”的AI,先来融它70个亿
OpenAI推理模型第一人Jerry Tworek离职不到一个月就创业,新公司Core Automation计划筹集10亿美元,要做具备「持续学习」能力的新型AI模型,解决主流模型‘训完就上线’、能力固定的问题。
摩尔线程天使投资人:对近期AI的四十个观察
摩尔线程天使投资人王捷整理关于AI经济四十个问题,涵盖模型发展、经济影响、就业冲击等方面,如Scaling Law收敛、AI扩散时间、数字层机制等,为探讨AI经济提供观察视角与分析框架。
摩尔线程算法一鸣惊人,图形学顶会夺银!已开源
12月17日,在SIGGRAPH Asia 2025上,摩尔线程凭借自研技术LiteGS在3DGS重建挑战赛中获银奖。3DGS是革命性3D场景表示与渲染技术,摩尔线程开源3DGS基础库LiteGS,实现全链路协同优化。
流式数据集:效率提升 100 倍!
现在只需一行代码,就能通过 `load_dataset('dataset', streaming=True)` 以流式方式加载数据集,无需下载。Hugging Face 优化后端,提升流式数据集速度与效率,减少请求、提升解析速度,还优化启动和流式加载阶段。
“75亿元投资理财”?摩尔线程回应
近期,摩尔线程拟将IPO募集的不超75亿元闲置资金用于现金管理引关注。公司称募投项目分阶段投入,此举为提高资金使用效率,不影响项目推进。12月20 - 21日将举办开发者大会。
750篇论文,彻底把统一多模态模型摸清了
未来迈向AGI需多模态AI系统。南大等联合发表综述,涵盖754篇文献。分析传统路线痛点,介绍统一多模态模型定义、技术路线、训练方法等,还提及应用场景及未来方向。
太简单啦,Call Center AI开源代码=AI语音客服,论文Demo一步到位,毕业设计神器!
Call Center AI是微软开源的AI呼叫中心解决方案,基于Azure相关服务和Azure OpenAI GPT,支持自动拨接电话等功能。能解决坐席不足等痛点,有一键API等亮点,适用于保险、IT支持等场景。
“交互式Scaling”:增加Agent与环境交互的深度和频率来提升性能
在AI发展中,商业研究Agent是“黑箱”,开源研究Agent性能有差距。MiroMind团队推出MiroThinker v1.0,提出“交互扩展”提升性能,在多基准测试表现出色,也指出了当前版本的局限。