「多语种支持」共找到 4826 篇相关文章
单卡2秒生成一个视频!清华联手生数开源TurboDiffusion,视频DeepSeek时刻来了
清华大学TSAIL实验室和生数科技联合开源视频生成加速新框架TurboDiffusion,能让视频生成在保证质量下最高提速200多倍,单张显卡就能运行,还整合四项关键技术,有诸多应用意义。
刚刚,OpenAI开放GPT-4.1,100万上下文、代码能力超强
今天凌晨1点30,OpenAI宣布开放GPT - 4.1,可在ChatGPT中使用。它针对编码任务,支持100万tokens上下文,在多项测试中表现优于前代,价格更优,不同用户将陆续获得使用权限。
MMLab@HKU 闪耀 CVPR 2025!与全球顶尖学者共话 AI 前沿
CVPR 2025 于 6 月 11 日至 15 日在美国纳什维尔举行,MMLab@HKU 携 24 篇高质量论文亮相。其还是三项国际竞赛的发起与主办方,主办六项前沿活动,研究成果展示了多领域进步。
把短视频做成流水线的AI剪辑神器
Pixelle-Video是一款AI剪辑神器,输入主题就能自动完成视频创作,零门槛。它采用模块化设计,流程清晰,各环节可灵活定制。支持多种AI模型、TTS方案,有丰富功能亮点。
一个For循环就是全部:BU开源了它的Agent框架
Browser Use团队开源bu - agent - sdk,设计理念简单,Agent就是一个for循环。它减少抽象、最大化模型自由度,解决了传统框架行动空间不完整等问题,支持多模型,开发者可自由选模型。
华为曝光两大黑科技!打破推理延迟魔咒,大模型从此「秒回」
华为通过FusionSpec和OptiQuant两大技术创新,对MoE模型进行推理优化。FusionSpec依托昇腾特点,将投机推理框架耗时降至1ms;OptiQuant支持灵活量化,为大模型推理提供高性价比。
刚刚,黄仁勋发长文:AI算力要变成一种「资产」
今天,黄仁勋在X发布长文,宣布NVIDIA与六家大型金融机构合作,推动AI工厂算力成新「可投资基础设施资产类别」,目标动员超5000亿美元第三方资本支持全球AI基建。
Anthropic工程师都离不开!深夜随手撸出的开源神器,被OpenAl高价收购,23人创业逆袭
昨日 OpenAI 宣布收购 Promptfoo 保障 AI 智能体安全,技术将整合进 OpenAI Frontier。该工具由 Discord 工程师开发,受诸多企业和开发者欢迎。收购后它将保持开源,继续支持现有客户。
NVIDIA开源“Banana”级黑科技!会懂物理、理解时间的图像编辑模型!
继谷歌Banana后,英伟达开源物理级图像编辑模型ChronoEdit - 14B,被称‘NVIDIA版的Banana’。它有‘时间观念’和‘物理常识’,能按描述生成符合物理规律图像,适用于多领域。
谷歌AI新里程碑:一个能「做研究」的系统诞生了,用LLM+树搜索编写专家级软件
谷歌提出能帮科研人员编写「专家级」科研软件的AI系统,融合大语言模型和树搜索,可整合重组知识构建新思路。在多领域超人类表现,但局限于可量化任务。