语音时长控制」共找到 1316 篇相关文章

算法论文7

超越Claude 3.5和o1!8B模型靠「分层投票+测试训练」逆袭

近日MIT研究者发现测试训练在大模型应对复杂推理问题,能分解任务提升回答准确率。8B的lemma3模型经此方法,在ARC和BBH数据集上性能显著提升,超Claude 3.5等。但该策略部署效率低。

新智元
算法论文8

JCP | 哈工大(深圳)胡钢团队:三维钝体流动中主动流动控制的深度强化跨域迁移学习

本文将基于相互信息的知识迁移学习与柔性动作 - 评论(MIKT - SAC)算法结合,解决主动流动控制中状态和动作维度的跨领域问题。应用于两个测试案例,结果显示该方法优于SAC算法,能显著减少训练间、降低阻力系数。

力学与人工智能
算法论文8

Snapchat提出Canvas-to-Image:一张画布集成 ID、姿态与布局

Canvas-to-Image 是面向组合式图像创作的全新框架,将不同控制信息整合在同一画布,简化图像生成控制流程。它解决了传统生成流程中控制方式分散的问题,能在推理阶段组合多种控制信号,实验效果良好。

机器之心
产品应用7

2亿多人开始和AI打电话,他们在聊什么?

2025年12月豆包月活达2.27亿,越来越多人与它语音通话。此前AI语音交互存在问题,豆包升级为全双工模型,体验更像打电话。作者实测其在不同场景表现出色,还分享使用技巧,并对比了和ChatGPT语音的优劣。

花叔
开源动态8

一站式机器人操作控制框架ManiUniCon

ManiUniCon是多进程机器人控制框架,为操作任务设计。有模块化设计、多机器人支持等特性,介绍了架构、支持的硬件、安装方法、使用方式、开发途径及可用工具等内容。

GitHubStore
算法论文7

研究表明:资深开发者在使用AI工具,完成任务的间比不使用延长了19%。

研究通过随机对照试验,发现2025年初资深开源开发者使用AI工具完成任务间比不使用延长19%。当前衡量AI能力多依赖标准化评测,可能高估或低估其真实能力,研究旨在更准确评估。

宝玉AI
算法论文8

推理扰动高熵词,增强LLM性能

香港科技大学(广州)研究团队发现LLM推理,一小部分高熵词显著影响输出正确性。基于此提出MTI方法,含Selective CFG intervention与Lightweight negative - prompt guidance,无需额外训练,能提升模型推理能力。

机器之心
开源动态7

MIT团队完成AI控制人类行为实验项目

MIT团队的Human Operator项目是实人体增强工具,也是MIT Hard Mode 2026获奖项目。它通过视觉 - 语言模型结合电刺激肌肉实现人体运动控制,介绍了技术栈、环境要求、软硬件准备、安装步骤等。

GitHubStore
算法论文8

谷歌揭秘:Multi-Agent 推理扩展才是未来。

谷歌DeepMind和MIT联合发表论文TUMIX,指出Multi - Agent是推理扩展的最佳方式,以低成本大幅提升准确率。实验表明Agent多样性优于重复采样,还展示TUMIX机制、实战表现,且LLM能设计更强Agent。

探索AGI
产品应用7

让AI自动化控制电脑的一切操作automation-mcp

自动化 MCP 是模型上下文协议服务器,为AI提供完整 macOS 桌面自动化能力,如控制鼠标、输入指令等。文章介绍了安装、使用工具、架构、安全权限、集成示例等内容。

GitHubStore