新紫光集团」共找到 3683 篇相关文章

产品应用7

ComposeMe:让发型、服饰与身份随心组合的人体图像生成范式

人像生成中保持效果清晰真实且自由调整细节是难题,Snap推出ComposeMe,引入‘属性特定图像提示’思路,能灵活组合属性。还建立数据集、提出训练方法,虽有局限,但表现较优。

带你学AI
算法论文8

NIPS2025 | A-Mem让Agent拥有动态自我记忆功能,达到SoTA

近年来,LLM代理需长期内存系统,但现有系统缺乏灵活性。论文提出A - Mem能动内存系统,受Zettelkasten启发,能让记忆‘自我整理’和‘自我更’,在多基准测试领先,也指出了局限性和未来方向。

深度学习自然语言处理
新闻资讯7

榜单CompileBench:让AI能搞定22年前的老代码

近日,CompileBench 测试 19 个 AI 模型编译真实代码能力,最难任务是复活 2003 年代码并交叉编译到 Windows 和 ARM64。不同模型表现不同,如 Claude Opus 4.1 成功完成 ARM64 静态编译,各模型有不同优缺点。

AI工程化
开源动态8

不止于快!美团推理模型正在重定义「实用主义AI」

美团发布并开源推理模型 LongCat-Flash-Thinking,它在权威测评表现突出。该模型有多项创,能更快、更能干、更可靠。其将技术实力转化为业务服务能力,实战测试表现佳,体现美团实用主义 AI 路径。

InfoQ
开源动态8

告别「面瘫」配音,InfiniteTalk开启从口型同步到全身表达范式

传统video dubbing技术有局限,兴模型也有问题。美团视觉智能部研发的InfiniteTalk引入‘稀疏帧video dubbing’,实现口型、表情、肢体与音频自然对齐,解决长视频生成难题,技术已开源。

机器之心
算法论文8

OmniHuman-1.5:让数字人拥有“思考”的视频生成范式

现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。

带你学AI
开源动态8

“边说边思考”,Mini-Omni-Reasoner 开创实时语音推理范式

Mini - Omni - Reasoner将推理能力引入大型语音模型,开创“边说边思考”范式,实现实时语音推理与交互。推出Spoken - Math - Problems - 3M数据集,经四阶段生成流程构建。训练采用分阶段策略,性能超基础模型。

GitHubStore
新闻资讯7

清北浙领跑两院院士候选!最年轻被提名人39岁

8月20日,中科院和工程院公布2025年院士增选有效候选人名单。清北浙领跑,最年轻候选人39岁。人工智能地位提升,机器人技术成优先支持学科,反映国家对兴领域的重视。

量子位
开源动态8

模仿人类推理修正过程,阶跃星辰提出形式化证明范式 | 开源

阶跃星辰发布并开源形式化定理证明大模型 StepFun-Prover-Preview-7B 和 32B。采用两阶段监督微调、工具集成强化学习及 RL 与 SFT 迭代循环优化等策略,在基准测试集表现佳,还展示多个证明案例。

量子位
算法论文8

VLA统一架构突破:自回归世界模型引领具身智能

北京智源研究院联合中科院自动化所提出 UniVLA 全 VLA 模型架构,基于全离散、自回归机制建模多模态信号,后训练引入世界模型。它刷多项基准纪录,在真机操控和自动驾驶有潜力,为多模态感知决策融合带来思路。

机器之心