零转全驱」共找到 2237 篇相关文章

开源动态8

新型开源端到端 AI 语音模型!Voila:195ms 超低延迟引领双工对话!

Maitrix团队发布开源AI端到端语音模型Voila,以195ms超低延迟及双工对话受关注。它功能强大,支持多语言,有多种使用方式,适用于多个场景,架构采用模块化设计。

开源星探
新闻资讯8

直击WAIC:萝卜快跑入选「国家队」,AI数字人技术升级,百度栈自研杀疯了

在世界人工智能大会 WAIC 上,百度成果亮眼。萝卜快跑入选「国家队」,出海进展快,还与 Uber 合作;数字人技术升级,发布 NOVA。百度靠栈自研技术体系支撑,目标是打造数百万个超级应用。

机器之心
产品应用7

实测Gemini图片视频新功能,终于蹲到经典梗图后续了(doge)

Gemini接入带声音的图片视频功能,作者实测该功能。用开盒指令测试,生成速度较快;还尝试给梗图加后续,发现生成精确内容需详细提示词,且不能生成具体真人形象内容。

量子位
新闻资讯8

Google 发了个压缩算法,内存砍 6 倍,速度快 8 倍,精度损失

Google Research发布TurboQuant压缩算法,将在下月ICLR 2026正式发表。该算法把大模型的KV Cache压缩到3 bit,内存降6倍、速度快8倍且精度损失,解决了传统算法的压缩开销问题。

AGI Hunt
产品应用8

0成本升级,快手OneSearch-V2量上线,生成式搜索进入「懂你」时代

快手技术团队在 OneSearch 基础上推出 OneSearch-V2 框架,解决电商搜索复杂查询理解不足等问题。该系统量上线,不增成本与时延,业务收益显著,还缓解信息茧房与长尾稀疏问题。

机器之心
算法论文8

机器人「看片」自学新技能:NovaFlow从生成视频中提取动作流,实现样本操控

布朗大学和机器人与人工智能研究所团队提出 NovaFlow 框架,利用视频生成模型常识知识,让机器人“看片”自学。它将任务理解与控制解耦,通过生成视频提取动作流,实现样本操控,为通用机器人提供新路径。

机器之心
算法论文8

重写手机AI安边界!首个MoAI攻防SoK,系统梳理三大安支柱

墨尔本大学等联合发布论文指出,移动端AI硬件和模型发展使MoAI成重要范式,但带来安风险。论文给出统一框架,拆解系统为四层,定义三大安支柱,梳理攻击、防御图谱等,还提出开放问题与未来方向。

新智元
推荐文章7

「AI大咖谈」顶尖量化机构Quant谈"算法工程师"量化方向的可能性与优劣势

文章是对顶尖量化机构量化研究员的匿名访谈,探讨算法工程师量化方向的可能性与优劣势,涉及收入、考核、压力、技能差距等方面,还提及量化岗位分类、市场环境及对机器学习的依赖程度。

王喆的机器学习笔记
新闻资讯8

阿里安AGI一次发布3款LLM,8B多维度领先GPT-5.4

近期,阿里安AGI实验室发布3款Yuvion LLM,在AI安与内容安领域多维度领先。它以‘对抗即智能’为原则,构建五类数据体系,采用三阶段训练范式,通过YLRE四级评测体系验证能力。

PaperAgent
算法论文8

Thinking Machines新发现:Lora不是权宜之计,哪怕秩低到 1,也能匹敌参数微调

Thinking Machines和John Schulman新研究刷新对LoRA的认知,实验显示正确使用时它能匹敌量微调。团队系统研究训练集与参数关系,有层选择、学习率等关键发现,还给出实用建议,但LoRA在部分场景表现待验证。

AI工程化