多语言处理」共找到 5438 篇相关文章

开源动态8

错过它=落伍!只用一张照片+14秒,腾讯开源 HunyuanVideo-Avatar 带你玩转角色数字人

HunyuanVideo-Avatar 是腾讯混元团队最新开放的模态数字人生成模型。上传一张人物图片,再配上一段音频,模型即可在约 14 秒内输出分辨率最高 720p、情绪可控、动作丰富且支持角色同屏的短视频。

小华同学ai
开源动态7

终于突破限制啦,11.2k Star LiveContainer,抓紧试一下!!!!

LiveContainer官方定义是app launcher,能将个IPA以访客App形式放进运行环境加载,可在现有iOS规则里降低测试摩擦,获11.2k Star。但它并非虚拟机或强隔离沙箱,使用有诸限制。

小华同学ai
开源动态7

DeepSeek 把 Harness 开源了:模型、工具、Agent Loop 全是插件

8月13日,DeepSeek面向全球开发者开放DeepSeek Harness开发者预览版v0.1并开源代码。其特色是一切皆插件,提供四种运行模式,内置Agent系统,有创新但编排范式未突破,还采用仅追加的会话日志。

InfoQ
算法论文8

首个时空时序推理框架:让大模型真正读懂时空数据 | ACL'26

STReasoner是首个结合时间序列、空间结构和自然语言的推理模型,能识别异常源、追踪影响路径。研究团队构建数据生成框架和评测基准,采用三阶段训练策略,模型在任务表现优,成本低且泛化能力强。

新智元
算法论文8

复旦北大联合美团LongCat提出TDAR:用“粗思考,细求证”破解Block Diffusion的速度精度悖论

复旦大学、北京大学联合美团LongCat提出Block Diffusion推理模型Test-Time Scaling新框架TDAR,引入‘粗思考,细求证’范式与有界自适应置信度解码,打破速度与精度零和博弈,在基准测试表现出色。

机器之心
产品应用8

GPT-5.2 发布:做表格、写 PPT、敲代码 | 打工人的生产力利器

GPT - 5.2发布,在GDPval评测等众基准测试中刷新行业水平。GPT - 5.2 Thinking适合真实场景与专业工作,在知识型任务、编码、长上下文处理、视觉理解、工具调用等方面表现出色,部分功能需付费使用。

AI进修生
开源动态8

长上下文快2.9倍,解码快6倍:Kimi 用线性注意力实现性能与效率双突破

月之暗面团队的Kimi Linear模型,是混合线性注意力架构,核心是Kimi Delta Attention模块。它解决线性注意力的记忆及遗忘问题,在任务测试表现出色,还开源相关资源,推动高效长上下文模型研究。

AIGC开放社区
算法论文8

清华首提通用大模型滤波方法,实现零样本状态估计|NeurIPS'25

清华大学李升波教授团队在NeurIPS 2025提出LLM - Filter通用滤波器,将状态估计融入大语言模型推理框架。它能解决传统方法泛化性差问题,在未见过系统中实现零样本状态估计,有望成基础模型。

新智元
推荐文章8

「All in AI」的 Shopify,分享了他们的全员 AI 落地实践,全是干货

Shopify 三个月前决定「All in AI」,副总裁 Thawar 分享公司引入 AI 的策略、提升效果与三个「反直觉」见解。如全员无差别用 AI、让 AI 展示思考过程、重视新手等,还给出个工作流案例。

Founder Park
算法论文8

首个可学习姿态对齐的视频扩散模型!StableAnimator++

当前人像动画扩散模型在人物身份一致性上表现不佳,复旦大学联合团队提出StableAnimator++,它是首个可学习姿态对齐的视频扩散模型,能生成自然保真的人物动画,还在保持人脸一致性上做了改进。

带你学AI