「大模型技术」共找到 10558 篇相关文章

开源动态8

腾讯开源Stand-In!轻量级身份保留视频生成新突破

生成符合指定身份的高保真视频挑战大,现有方法依赖大参数且兼容性不足。腾讯开源轻量级、即插即用的Stand - In框架,在身份保留文本生成视频任务中性能先进,兼容性强,有广阔应用潜力。

带你学AI
新闻资讯7

Artificial Analysis:DeepSeek成为世界前二AGI实验室

模型与API独立分析公司Artificial Analysis对DeepSeek R1-0528评估显示,其一举超越xAI、Meta等,与谷歌并列全球第二大人工智能实验室,在多方面性能提升,缩小了开源与闭源模型差距。

AI寒武纪
开源动态8

一键式训练端到端Agent,Qwen3+MCP工具集高效集成!

RLFactory是开源的端到端RL后训练框架,将环境与训练解耦,用Qwen3基座调用MCP工具集,可低代码训练端到端Agent模型。它极致易用、训练高效,还支持一键式训练,未来会更易用高效。

深度学习自然语言处理
算法论文8

EMNLP2025 | LLM多次回答一致就一定正确吗?非也

随着LLMs在高风险领域广泛应用,其输出的事实性错误引发安全质疑。中科院计算所和美团团队论文揭示自我一致错误,传统检测方法对此失效,提出跨模型探针法提升检测能力。

深度学习自然语言处理
开源动态8

GitHub 1.3k 一款能“填色回忆”的神器:DDColor 让老照片鲜活又逼真

DDColor是阿里达摩院团队提出的新一代图像自动着色模型,基于双重设计,能实现高保真、真实感强的黑白图转彩色图。它兼容多种类型图片,有诸多核心功能,相比传统模型优势明显,应用场景广泛。

小华同学ai
开源动态7

ICML25 | 让耳朵「看见」方向!仅依靠360°全景视频,就能生成3D空间音频

空间音频技术成提升沉浸式体验关键,但现有技术未充分利用360°全景视频空间信息。OmniAudio研究可直接从360°视频生成空间音频,相关代码和数据集已开源,虽有局限但前景好。

量子位
新闻资讯8

代码生成越来越快,软件交付真正的瓶颈转向了哪里?

本文整理了2026云栖大会AI Native研发实践论坛的嘉宾分享,围绕代码生成提速后软件交付的新瓶颈问题,展示了阿里各业务线与学界的最新实践,探讨AI Native研发新方向。

机器之心
新闻资讯7

刚刚,29岁IOI金牌华人收购Windsurf剩余团队!OpenAI 30亿彻底梦碎

29岁华人IOI金牌创始人Scott Wu官宣Cognition AI收购AI编程工具Windsurf,涵盖其知识产权等。此前谷歌已斥资24亿收购部分团队获技术授权,OpenAI 30亿收购梦碎。Cognition将整合技术打造产品生态。

新智元
新闻资讯8

独家|前小米崔宝秋低调创业,揭开家庭机器人的最优解

前小米“技术教父”崔宝秋创办家庭具身机器人公司“若伴科技”,获全明星阵容“亲友+种子轮”融资。他有深厚技术与产品经验,其设想的家庭机器人将打通小米生态,且结合开源构建数据闭环。

AI科技评论
新闻资讯7

MiniMax修改开源授权被骂疯了!限制M2.7商用、强制标注来源,却没完全撤下MIT标识

近日,MiniMax M2.7 模型变更开源使用条款,收紧商业授权,引发社区热议。MiniMax 称此举为防第三方‘阉割降级’模型。但标注‘Modified - MIT’却限制商用引开发者质疑,此前 MiniMax 一直完全开源。

AI前线