同步语音技术」共找到 3167 篇相关文章

开源动态8

离大谱!15k Star book-to-skill,我惊到了!!!

book-to-skill是将书籍、文档目录或多份资料转换成Agent Skill的命令行工具。它把资料拆成可按需加载的知识资产,有按需加载章节等优势,适合将常用知识编译成技能,不过也有一定局限性。

小华同学ai
新闻资讯7

Sutton、OpenAI 联创押注的持续学习,有中国团队带着模型进场了

7 月,TML 发布 Inkling 模型,Mind Lab 发布 Macaron V1,二者均针对持续学习场景。持续学习走「参数空间的迭代」路线,让模型用得越多越好用。硅谷已有不少新尝试,产业链正在形成。

Founder Park
新闻资讯7

马斯克诉OpenAI案终落幕:1500亿索赔因“告晚了”被驳回

2026年5月18日,“马斯克起诉OpenAI”案裁决,OpenAI无需担责,马斯克诉求被驳回,原因是诉讼时效已过。这场官司拉扯两年多,索赔从数十亿增至1340亿美元。庭审暴露双方问题,后续资本战将开启。

DeepTech深科技
新闻资讯7

独家|浙大00后世界模型创业,完成新一轮亿元融资,已在多个产业领域实现交付

2021年浙大陈天润成立魔芯科技,早期围绕AI驱动3D内容生成。2024年底转向3D场景建模和世界模型,走纯隐式方法。团队年轻有优势,已产生收入,完成融资,将推新模型,目标是实现‘3D的ChatGPT时刻’。

DeepTech深科技
产品应用8

AnyGen款新AI工具,专门解决打工人最头疼的3件事,Doc,PPT,Excel

字节跳动2025年12月在海外推出一站式AI协作工作台AnyGen,强调人机协作打磨。产品有文档、通用智能体、幻灯片、数据分析四个核心模块,能解决会议纪要整理、PPT制作等痛点,还与主流工具做了横评。

AI Reading Hub
算法论文8

强化学习的进化:从PPO到MaxRL,LLM推理训练的算法演进史

本文概述2024 - 2026年推理LLM的强化学习进展,从REINFORCE和PPO讲起,介绍GRPO、RLOO等多种算法。指出critic模型非必需,标准差归一化有副作用,损失聚合很关键,信任域是优化切入点,还提出几个未解决的挑战。

机器之心
推荐文章8

热门 Skill 精选介绍

文章介绍热门Skill,含元技能、专家经验包、前端设计开发等多领域技能。如find - skills可帮用户发现安装技能,frontend - design强调前端设计美学,last30days能生成多平台趋势研究报告。

AIGC开放社区
开源动态8

刷屏了!开源 2 天斩获 41K+ 标星!这个 OpenAI 赞助的 AI 终端 Warp 开源了!

Warp宣布开源,不到24小时GitHub Star数达3.5w+,现超41K。它从现代终端演变成Agent化开发环境,由OpenAI赞助。采用双轨制开源协议,推出“Agent优先”工作流,同步产品升级。

开源星探
产品应用7

声音自然、接近真人,只要 3 秒音频就能完成声音克隆,可本地跑保护隐私的TTS!

Neuphonic出品端侧TTS模型NeuTTS,能在本地设备高效运行,无需云服务。它有真正端侧运行、低延迟、高质量自然语音等特性,支持多语言,项目还给出安装、使用方法及支持模型等信息。

GitHubStore
新闻资讯8

万字长文梳理「罗福莉」三个半小时的访谈:2026年不是Agent元年,是生产力爆发年

小米大模型负责人罗福莉在访谈中复盘技术剧变,分享对OpenClaw的认知转变,阐述Agent框架本质,介绍MiMo V2架构选择,探讨人跟Agent共创、多模态Agent等内容,判断2026年生产力将爆发。

开源AI项目落地