「多任务训练」共找到 6683 篇相关文章
Linear-MoE:线性注意力遇上混合专家的开源实践
近年来,线性序列建模和混合专家(MoE)研究进步大,但两者结合研究少,相关开源实现缺失。上海人工智能实验室团队的 Linear - MoE 首次实现两者高效结合并开源技术框架,实验验证其有诸多优势。
两年内打造AI软件工程师!OpenAI Codex 作者解密人机结对编程新模式
AI科技大本营编译访谈,OpenAI的Josh Ma与Alexander Embiricos分享Codex项目,包括缘起、人与AI结对编程范式,还探讨产品形态、最佳实践等,预测两年内打造智能体软件工程师。
最新!OpenAI:GPT-5将实现大统一,Codex最佳实践是这样的
OpenAI Codex在Reddit AMA活动中,核心负责人围绕先推云端代理、GPT - 5与Operator整合等问题给出路线图。如Codex - 1预览情况、CLI设计、使用场景、安全模型、接入计费及API生态等方面都有说明。
登顶 Arena!MiniMax 最新 Speech-02 模型屠榜:超越OpenAI、ElevenLabs,人声相似度99%
近期TTS模型领域发展火热,众多机构纷纷发力。MiniMax推出的Speech - 02模型登顶Arena榜单,在字错率和相似度等指标上表现出色,具备超拟人、个性化、多样性特点,性价比高,还创新架构解决了现有痛点。
重磅!Google 推出AlphaEvolve 实现算法自我进化,将颠覆数学与计算机科学!
Google DeepMind发布革命性的Gemini驱动编码代理AlphaEvolve,能设计并优化算法。它发现更快矩阵乘法算法、解决开放性数学问题,还优化了Google多方面计算基础架构,未来跨领域应用前景广。
Hugging Face 冲榜不完全指南:一个小众 ASR 模型,是怎么冲到榜一的?
本文拆解了网易有道新开源的真流式语音识别模型R2T2,从冷启动到登顶Hugging Face ASR热榜第一的完整路径,总结了小众开源模型冲榜的实操经验,对开源项目运营有较高参考价值。
刚刚,OpenAI宣布内部模型批量攻破100多道数学难题,普林斯顿高研院正式介入
本文报道OpenAI最新AI进展,其内部新模型批量攻破100多道长期悬而未决的公开数学难题,联合普林斯顿高等研究院成立独立学术顾问小组规范成果评估,引发数学界震动。
YC 2026 Startup 复盘:硬件、数据的都在挣钱,应用团队开始自己训模型了
本文是YC核心团队基于过去12-18个月的创业项目数据,复盘AI创业生态的最新变化,拆解硬科技、软件、数据服务等赛道的新机会与趋势,为AI创业者提供方向参考。
拒绝OpenAI和Anthropic邀约,DeepMind安全研究员离职转向独立测评
本文报道,多名头部AI机构研究员因AI安全顾虑离职,DeepMind AGI安全研究员Engels拒绝OpenAI、Anthropic邀约,加入独立评测机构METR,围绕AI递归自我改进失控风险展开讨论。
深度|AI开始接管物理世界,谁来掌握新的入口?
本文为深度行业分析,围绕Anthropic推出的模型硬件标准MHS展开,探讨AI从虚拟屏幕切入真实物理世界、接入实验设备的产业进程,梳理核心挑战与未来竞争格局。