「端到端AI」共找到 10699 篇相关文章

开源动态8

连续自回归的dots.tts:小红书开源语音合成模型「基座」

语音合成赛道发展如早期大语言模型,路线未收敛。小红书与上海交通大学合作开源的 dots.tts,是 20 亿参数、全连续、端到端自回归 TTS 基础模型,有准确度高、可扩展等特点,还开源了代码。

机器之心
开源动态7

最强DeepResearch!通义DeepResearch-30B开源实战:模型部署+LangGraph+A2A全攻略

阿里发布全开源项目通义DeepResearch,在研究任务评测中表现出色,底层是30B的MoE专用推理模型,资源需求低。文章演示了基于该项目构建本地化端到端DeepResearch助理的方法,包括模型部署、Agent实现等。

AI大模型应用实践
开源动态8

视觉Token注入CLIP语义,走向多模态理解与生成新范式

腾讯ARC Lab等机构提出全新视觉分词器TokLIP,将低级视觉Token与高级CLIP语义结合,支持端到端自回归训练,可接入LLM框架,降低计算与数据门槛,在多模态任务中表现优异,代码已开源。

量子位
算法论文8

《TAML》好文推荐 | 来自清华大学张宇飞团队最新研究成果 基于文本生成翼型:FoilCLIP,一种语言驱动的气动设计新框架

传统翼型设计依赖CFD和风洞试验,成本高。清华大学张宇飞团队提出端到端双向映射框架FoilCLIP,通过对比学习建立文本与翼型几何双向映射,还提出数据增强策略,验证了其在语言驱动设计中的应用潜力。

力学与人工智能
推荐文章7

软件的新玩法:如何 Fork 一个技能库|AGIX PM Notes

文章围绕软件新玩法展开,指出软件正从面向人向面向机器转变,Claude Skills 代表新范式,软件或消解为面向 LLM 的 skill.md 文件。还涵盖市场总结、AI 动态及 ETF 知识等内容。

海外独角兽
新闻资讯8

刚刚,Jev全网解禁!1.2亿Token限时免费用

本文报道TypeSafe AI旗下专做结构化决策判断的AI模型Jev全网解禁,开放所有用户直接使用,新用户赠送1.2亿Token额度且输出免费,Jev配合大模型的玩法引发全球开发者热潮,展示了多个实用落地场景。

新智元
推荐文章7

一文带你看懂,火爆全网的Skills到底是个啥。

文章介绍了火爆AI圈的Skills,它热度堪比当年的Prompts。文中通过AI选题系统和整合包生成器两个案例展示其应用,还对比了它与Prompt、MCP的区别,介绍了基本配置及安装方法,强调其价值在于复用。

数字生命卡兹克
新闻资讯8

专访丨华人大三学生创业教育 Agent,获赵长鹏 1100 万美元种子轮

硅谷华人大三学生创立的教育类 AI 产品 VideoTutor 完成 1100 万美元种子轮融资,由赵长鹏家办 VC 领投。这是面向 K12 学生的 AI 教育 Agent,能一键生成专属教学视频。文中还探讨了其功能、优势及团队发展规划。

特工宇宙
新闻资讯7

谷歌约战,DeepSeek、Kimi都要上,首届大模型对抗赛明天开战

太平洋时间8月5 - 7日,8款前沿AI模型将在Kaggle Game Arena展开为期3天的国际象棋比赛,参赛方都是AI界顶流。谷歌称现有基准测试难跟上模型发展,这场比赛是探索新评估方法。赛制为单败淘汰制。

机器之心
算法论文8

仅看视频就能copy人类动作,宇树G1分分钟掌握100+,UC伯克利提出机器人训练新方式

UC伯克利团队研发出名为VideoMimic的新系统,能将视频动作迁移到真实机器人。它已让宇树G1模仿100多段人类动作,还能适应各种地形。其工作流程含视频转仿真、仿真训练策略、策略迁移到实体机器人。

量子位