专家级表现」共找到 3397 篇相关文章

算法论文8

ACL 2025 高分接收 | 高感情语音技术:逻辑智能小语种TTS破局之道

语音合成技术在大语种发展好,但小语种因语料稀缺等面临挑战。逻辑智能团队提出针对低资源语言TTS的解决方案,构建泰语数据集,经先进预处理,其TTS模型效果好,有零样本克隆能力。

机器之心
新闻资讯7

Claude 4发布:最强AI编程模型+最强AI Agent基建!

Google I/O大会后一天,Anthropic凌晨发布Claude Sonnet 4和Claude Opus 4。Claude Opus 4是“世界上最好的编程模型”,Claude Sonnet 4适合日常编程。此次更新有四大核心改进,聚焦开发者。还介绍了工作模式、定价等。

花叔
算法论文8

DiffMoE:动态Token选择助力扩散模型性能飞跃,快手&清华团队打造视觉生成新标杆!

清华大学和快手可灵团队推出DiffMoE,通过创新的动态token选择机制和全局token池设计,拓展了扩散模型的效率与性能边界。实验表明,DiffMoE在多方面超越现有模型,未来集成先进技术或有新增益。

机器之心
开源动态8

ICML 2025 | 长视频理解新SOTA!蚂蚁&人大开源ViLAMP-7B,单卡可处理3小时视频

在视觉语言模型取得突破的当下,长视频理解挑战凸显。蚂蚁和人大团队提出视觉语言大模型ViLAMP,采用‘混合精度’策略,在多基准测试中超越现有方案,单卡可处理3小时视频,为实际应用带来新可能。

机器之心
产品应用7

The Batch: 978 | DeepSeek-V4-Pro 更新了

DeepSeek发布旗舰模型DeepSeek-V4-Pro-0813正式版,性能提升,还发布开源agent harness开发者预览版并提价。模型在多指标表现佳,编码能力改进明显,公司公开基准测试框架意义大。

DeeplearningAI
新闻资讯8

独家专访临界点CEO乔天杰:机器人运动会7冠背后,灵巧手真正该比什么?|甲子光年

8月22 - 26日,第二届世界人形机器人运动会举行,灵巧手首次单独参赛。临界点携OmniHand获7金4银3铜,CEO乔天杰接受专访,探讨灵巧手能力衡量、自由度、工程化及产业应用等问题。

甲子光年
开源动态8

AI能否独立开展科研?ASI-Bench为科学自主性建立评测标尺

ASI-Bench是衡量AI系统科学自主性的基准测试,由多机构联合开发。它能测试AI通用智能、创新性和执行力,通过信息梯度设计,让模型在不同指导量下完成科研任务,结果显示当前AI离自主科研有明显距离。

机器之心
推荐文章8

“大脑在硅谷,身体全靠中国!”机器人泰斗揭秘真相:后空翻只是杂耍,端起咖啡才是真AI

在最新一期播客中,机器人学泰斗 Sergey Levine 与 Ryan Peterman 深度对话,触及行业焦点如机器人发展阶段、波士顿动力淡出原因等。他强调,机器人技术尚处底层搭建期,需重视先验知识、软硬件结合,跨越鲁棒性门槛。

AI科技大本营
新闻资讯7

Claude两个新模型实测流出!空间推理封神,算力直接榨干了

Claude两款新模型“棉花糖”和“甜瓜”实测流出,在3D强化学习和建筑空间布局上性能强大,还能直接理解并生成复杂3D坐标和空间关系。它们对算力吞噬疯狂,引发对其身份的猜测。

新智元
新闻资讯7

OpenAI解散「灾难风险应急」团队!GPU大神Scott Gray也跑路了

OpenAI解散「Preparedness」团队,该团队负责评估自家AI灾难社会风险。官方称安全工作已融入开发流程。此前多个安全团队也已解散,多名安全高管离职,引发员工不安。

量子位