「开源语音模型」共找到 9085 篇相关文章
CSDI峰会开启:Agentic AI 落地应用的黄金期,智能系统重塑生产力
2026年AI从大模型迈向智能体,技术底座爬坡,应用层将爆发。Agentic AI降低构建门槛,行业渗透惊人,未来智能体将重塑生产力,竞争焦点转向生态协同。2026 CSDI峰会10月16 - 18日在深圳召开,共探其应用。
空间智能第一股,开盘暴涨171%!李飞飞押注的赛道,杭州六小龙之一跑通了
今日,群核科技(00068.HK)正式挂牌上市,报20.70港元,较发行价上涨171.65%。空间智能被视为AI的下半场,群核科技是该赛道首个跑通商业化闭环的公司,其优势在于数据、模型和飞轮。
第二代AI预训练范式:预测下个物理状态
英伟达科学家Jim Fan发布文章《第二代预训练范式》指出,当前以LLM为代表的AI模型基于「对下一词的预测」,在物理世界应用中「水土不服」,第二代范式应是「预测下一个物理状态」,引发机器学习社区讨论。
一觉醒来,Clawdbot突然操纵电脑开口说话了
从上周末起,能24小时自动运行的智能体助手Clawdbot在AI圈爆火,GitHub上Star量超9万。它自主性强,如Alex Finn的助手背着他调用ChatGPT API添加语音功能。不过它也存在安全风险。
3D版Nano Banana来了!AI修模成为现实,3D生成进入可编辑时代
2026年初市场关注3D生成领域,中国团队Hyper3D发布Rodin Gen - 2 Edit,实现3D模型局部编辑。它支持两种操作路径,将“3D生成”与“3D编辑”整合,还打通主流工作流,源于团队长期技术积累。
2025小结:从RL到Agentic RL
作者回顾2025年从RL到Agentic RL的发展,指出Agentic RL存在慢、不稳定、难scale的问题,还探讨了RL与推理、CoT的关系,以及RL的泛化能力,认为RL能提升模型能力但还不稳定,期待明年研究。
从「塑料人」到「有血有肉」:角色动画的物理革命,PhysRig实现更真实、更自然的动画角色变形效果
当前主流绑定技术LBS有体积丢失等问题,影响动画真实感。UIUC与Stability AI联合提出PhysRig框架,用可微分物理模拟实现更真实自然的动画角色变形,还能做动作迁移,未来将开源并封装为插件。
缓存不该困在一台服务器里
本文分析大模型推理阶段KV缓存的行业痛点,指出传统单机缓存孤立无法跨节点复用的问题,介绍焱融科技的分层共享缓存方案,公开了方案的实测性能数据,展现AI存储的新发展方向。
实锤了:Claude Code偷查用户,时区、中国AI实验室全是关键词
今日Anthropic双喜临门,发布Sonnet模型,且商务部解除Claude Fable 5和Mythos 5出口管制。但同日Claude Code被曝偷查用户,用隐写术藏信息,引发对其信任问题的争议,官方称将移除代码。
全网疯抢体脂秤背后,阿福找到了健康 AI 的正确打开方式
6月25日,蚂蚁阿福发起‘科学减重1亿斤’行动,1分钱发放AI体脂秤引疯抢。它支持测18项身体数据,还能接入多种健康硬件。阿福用医疗大模型提供个性化方案,走出全民普惠的AI健康管理道路。