「文心大模型5.0」共找到 8827 篇相关文章
腾讯祭出开源核弹!LeVo音乐生成模型,媲美Suno,支持零样本风格迁移,歌词完美匹配
音乐生成领域有重大突破,腾讯AI Lab开源高保真音乐生成模型LeVo。它由LeLM和音乐编解码器组成,能解决现有方法在音质、音乐性等方面的局限,实验显示其优于现有方法,功能强大且适用场景多。
刚刚,OpenAI发布GPT-5-Codex:可独立工作超7小时,还能审查、重构大型项目
凌晨1点,OpenAI发布针对编程优化的GPT-5-Codex,它能独立工作超7小时,可审查、重构大型项目。还宣布Codex升级,包括新CLI和IDE插件等,同时介绍安全保护措施、价格及可用性。
奥特曼首次透露GPT-5上手体验:在擅长领域感到无力,往后一靠感到眩晕
OpenAI掌门人奥特曼在深度访谈中透露上手GPT - 5的体验,称在擅长领域感到无力、眩晕。他还抛出孩子不会比AI聪明、AI CEO或接管OpenAI等观点,探讨AI竞争及硬件适配问题。
告别大模型“失忆”!人大开源MemSifter:轻量代理先思考再回忆,搞定长时记忆
中国人民大学团队提出全新LLM记忆管理框架MemSifter,打破长时记忆管理‘精度不够’和‘成本太高’的困局。它将记忆检索‘外包’给轻量级代理模型,采用任务结果导向的RL训练范式,在8个基准测试中超越现有SOTA方案。
别再纠结选哪个模型了,这个项目让它们一起干活!豪赠1亿token,羊毛薅起来!
元脑企智 EPAI 推出「多模融合」API,让多个模型围绕同一任务协同工作。经代码生成、财务分析等测试及权威评测,效果出色。还采取智能调度等策略,现限时申请可免费使用,豪赠1亿token。
Claude 急了!模型降智,官方长文用 bug 搪塞?开发者怒怼“太晚了”:承认不达标为何不退钱?
8月至9月,Claude模型质量下降,Anthropic将问题归咎于三项基础设施漏洞。开发者不满,质疑官方用bug搪塞,要求退款。官方虽剖析问题并提出改进方案,但很多用户已不再买账,Claude用户流失问题持续数月。
7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开
北京中关村学院7名跨专业博士生,耗时3个月从零训练出7B参数大模型ZGCM-1,采用数百个Agent协作实践AI4AI研发范式,全程公开代码、数据、权重、训练日志,分享一线实战经验。
9.1K Star 调参师集体失业!亚马逊造出机器学习“核弹”,3行代码打造高精度模型!
在机器学习普及的当下,自动化机器学习框架降低开发门槛。AutoGluon由AWS AI开发并开源,仅3行代码就能训练和部署高精度模型,支持多类型数据,有诸多亮点,已获9.1K Star。
当10亿个AI一起模拟未来:李飞飞和Karpathy共同押注的新赛道|5Y Research
本文聚焦Multi - Agents模拟预测这一AI前沿方向,介绍其发展、原理、应用场景及代表公司。它能为人类社会建可反复运行的“世界模型”,虽潜力大,但面临验证难、技术瓶颈等问题。
扔掉人工公式:快手EMER框架,用“会比较、自进化”的模型重构短视频推荐排序
过去十年,推荐排序多依赖人工设计公式,但此模式遇瓶颈。快手策略算法团队提出 EMER 框架,用“会比较、能进化的 AI 模型”重构短视频推荐排序,在快手主 App 和极速版效果显著,还为行业提供解决方案。