「模型训练难题」共找到 8750 篇相关文章
首个自主数据科学的智能体
DeepAnalyze是业界首个能自主完成数据科学任务的智能体大语言模型,可自动执行数据准备、分析等任务,支持多种数据源,且模型、代码等全部开源,还给出了使用和开发方法。
AI牛马实现“干中学”!上海AI Lab联合推出智能体自我进化新框架
上海人工智能实验室等研究者提出MUSE智能体框架,让智能体实现“干中学”。它围绕分层记忆模块,通过先做、再反思、然后进化,解决现有智能体痛点,实验表现出色,还展望了未来优化方向。
AI 引领的企业级智能分析架构演进与行业实践
在 QCon 全球软件开发大会(北京站)上,数势科技 AI 负责人李飞分享了企业级智能分析架构演进与实践。探讨了智能分析落地问题,介绍 Agent 结合数据分析优势、技术路线及落地要点,还对 Agent 发展给出思考与展望。
摆脱遥控器,波士顿动力人形机器人,开始「长脑子」干活了
世界人形机器人运动会引发对人工遥控机器人的争议。波士顿动力与丰田研究院合作为 Atlas 开发大型行为模型,展示其自主收纳整理成果,模型构建有流程,成果显著,研发遵循三项核心原则。
腾讯开源Stand-In!轻量级身份保留视频生成新突破
生成符合指定身份的高保真视频挑战大,现有方法依赖大参数且兼容性不足。腾讯开源轻量级、即插即用的Stand - In框架,在身份保留文本生成视频任务中性能先进,兼容性强,有广阔应用潜力。
OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式
现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。
AI改造出行体验:滴滴的试验能否开启行业范式转变?
滴滴近日面向公众内测上线出行AI助手小滴,颠覆传统打车模式。它能精准理解需求,提供个性化方案,还可进行时空推理和订单规划。滴滴用工程打法攻克难题,还上线MCP服务助开发者定制助手。
当 Agent 尝试接管浏览器,连“我是人类”都证明不了?上海交大开源发布交互评测基准 HLL
随着多模态大模型发展,Web Agent 面临验证码挑战。上海交通大学等团队发布 HLL 评测基准,解耦真实度为三维度,对 8 款前沿模型测试,揭示 Agent 在多步交互微操上的短板。
EMNLP2025 | LLM多次回答一致就一定正确吗?非也
随着LLMs在高风险领域广泛应用,其输出的事实性错误引发安全质疑。中科院计算所和美团团队论文揭示自我一致错误,传统检测方法对此失效,提出跨模型探针法提升检测能力。
GitHub 1.3k 一款能“填色回忆”的神器:DDColor 让老照片鲜活又逼真
DDColor是阿里达摩院团队提出的新一代图像自动着色模型,基于双重设计,能实现高保真、真实感强的黑白图转彩色图。它兼容多种类型图片,有诸多核心功能,相比传统模型优势明显,应用场景广泛。