「训练技术」共找到 4626 篇相关文章
苹果AI自研不动,库克外包给谷歌Gemini了
今天凌晨,苹果与谷歌官宣达成深度合作协议,基于Gemini模型和谷歌云技术构建下一代苹果基础模型,成果之一是今年内上线“更个性化的Siri”。此前苹果自研AI推进不顺,人才流失严重。
医疗领域DeepSeek时刻:蚂蚁 · 安诊儿医疗大模型正式开源,登顶权威榜单
2026 年初,OpenAI 报告显示不少人用 ChatGPT 咨询医疗问题,还发布了 ChatGPT 健康。近日,蚂蚁集团等开源的蚂蚁・安诊儿医疗大模型或成最优解,它参数量大,在多评测中登顶,技术优势明显。
注意力机制大变革?Bengio团队找到了一种超越Transformer的硬件对齐方案
Transformer虽改变世界但不完美,线性递归等新方法理论有优势,实际在GPU表现不佳。Bengio团队提出硬件对齐算法框架,用滑动窗口循环和B2P算法,实验显示有速度与质量双重突破。
告别“音画割裂”与“人物崩坏”!AutoMV:首个听懂歌词、卡准节拍的开源全曲级MV生成Agent
现有AI视频生成模型做全曲MV有时长限制、音画割裂和一致性差等问题。AutoMV作为开源多智能体系统,模拟人类影视制作流程,能生成长达数分钟、叙事连贯且音画同步的完整MV。
今年TRAE写的代码:100000000000行!超50%程序员每天在按Tab键
2025年末TRAE发布年度产品成绩单,一年写1000亿行代码、超50%用户高频用Tab键。其Cue功能助行业进入人机共生,SOLO模式让开发者成指挥者。它历经三阶段,指标优、构建生态,是中国AI IDE领域领先者。
首创郎园成功举办AIGC视听产业人才新生态大会
2025年首创郎园AIGC视听产业人才新生态大会在北京举办,由多机构联合主办,众多高校、企业及嘉宾参与。大会聚焦构建产业‘星探’平台,展示成果、成立矩阵、发布资源包、启动大赛等,推动人才与产业对接。
Ilya重新定义AGI: 为什么ChatGPT离真正的AGI还很远
OpenAI前首席科学家Ilya在访谈中提出对AGI的新定义,还指出AI规模时代结束,未来拼想法和研究深度。他分析模型评测强但经济影响弱的原因,阐述人类价值函数作用,且SSI战略或调整。
用企业级智能体落地,还有谁没踩这四种大坑?无问芯穹的系统性解法来了
企业级智能体落地遇效果、稳定、成本和商业闭环四大难题,无问芯穹推出智能体服务平台,从多方面提供解决方案,并展示SysCoding Agent案例,其基础设施或成企业拉开差距关键。
性能不减,吞吐量提升6.4倍!英伟达用混合算子和架构定义小模型新标准
NVIDIA研究团队通过Nemotron - Flash系列模型,打破对‘深而瘦’架构迷信,修正缩放定律,用进化算法搜索混合算子、改进训练策略。该模型在性能、延迟和吞吐量上表现出色,远超同类产品。
Snapchat提出Canvas-to-Image:一张画布集成 ID、姿态与布局
Canvas-to-Image 是面向组合式图像创作的全新框架,将不同控制信息整合在同一画布,简化图像生成控制流程。它解决了传统生成流程中控制方式分散的问题,能在推理阶段组合多种控制信号,实验效果良好。