T2V技术」共找到 4434 篇相关文章

开源动态8

Google刚刚开源的一款AI工具,Gemini 2.5驱动浏览器自动化!

Google在GitHub开源AI浏览器自动化工具Computer Use Preview,基于Gemini 2.5模型,用自然语言控制浏览器完成复杂任务。支持双环境,集成Gemini API/Vertex AI,适用于Web测试等,零代码入门。

开源星探
新闻资讯8

李飞飞最新播客:AI 是一项文明级技术,以人为本是关键

AI教母李飞飞在High Signal播客指出AI是文明级技术,分享构建以人为本AI的见解,涵盖研究动机、好奇心作用、AI同心圆层级等话题,还强调空间智能重要性,给出AI发展建议。

AGI Hunt
新闻资讯7

我在618主场,和3位顶尖技术博士聊了聊

本文讲述了作者在618与京东三位技术博士的交流。长林主导同品判别系统优化,采用模型蒸馏和数据筛选提升效率;星衍负责物流机械臂项目,强调打透场景;初雪专注语音识别,提升识别准确率和探索创新方向。京东还推出TGT计划吸引人才。

量子位
开源动态7

用开源中转统一接入Claude/OpenAI/Gemini:Sub2API核心功能解析

若同时用Claude、OpenAI、Gemini等,会面临账号分散、API Key管理难等问题。Sub2API是开源一站式中转服务,能统一接入这些订阅,还具备多账号管理、精确计费等功能,有多种部署方式。

小华同学ai
算法论文8

Lumina-mGPT 2.0:自回归模型华丽复兴,媲美顶尖扩散模型

上海人工智能实验室等团队提出Lumina - mGPT 2.0自回归模型,统一多种图像任务。它采用独立训练架构、统一多任务处理框架和高效推理策略,实验表现优异,后续将优化采样时间并扩展至多模态理解。

机器之心
产品应用8

DeepSeek-V3.2-Exp:用稀疏注意力打破长文本效率瓶颈

在NLP领域,处理长文本时传统注意力机制效率低。DeepSeek团队推出DeepSeek-V3.2-Exp模型,引入稀疏注意力机制,在保持性能同时提高长文本处理效率,降低计算复杂度,在多基准测试中表现良好。

CourseAI
开源动态7

Moonshot AI发布Kimi Linear技术报告,采用混合线形注意力架构

Moonshot AI在Hugging Face发布Kimi Linear技术报告,该48B参数模型采用混合线性注意力架构,称超越传统全注意力机制。官方数据体现其优势,模型已开源,社区反应不一,MiniMax则回归全注意力架构。

AI工程化
算法论文8

FlashAttention 完全进化史:FA-4 发布之际的技术全景回顾

文章围绕FlashAttention展开,从Attention性能瓶颈引出问题,阐述其各版本演进。FA-1实现算法突破,避免O(N²)内存;FA-2适配架构,提升性能;FA-3深度协同,实现异步;FA-4探索更深异步和角色分工。还探讨跨芯片迁移及未来优化方向。

GiantPandaLLM
开源动态8

故障率降低100倍,微软突破性技术破解AI算力浪费大难题

在AI数据中心,网络链路高故障率制约算力释放。微软在“ACM SIGCOMM 2025”大会公布MOSAIC技术,将链路故障率降100倍,实现50米长距传输、最高68%功耗降低,为大规模AI集群提供支撑。

AIGC开放社区
产品应用8

中国AI Agent产业化参考范本:斑马口语攻克的四大技术难关

2025年AI产业转折,通用大模型落地难,垂直场景成关键。斑马口语作为垂直落地的AI Agent,突破实时交互、语音识别、内容适龄、多模态呈现四大技术难关,为中国AI Agent产业化提供范本。

机器之心