音频测试」共找到 1846 篇相关文章

产品应用7

The Batch:924|GPT-5.4:性能更高,价格也更高

OpenAI更新旗舰模型GPT-5.4,有Thinking和Pro两个版本,扩展工具使用能力,多基准测试达当前先进水平,但定价高。虽在部分任务表现超Claude,挑战Gemini地位,不过成本也更高。

DeeplearningAI
新闻资讯7

安全的下一个好赛道,非常值得研究

近几年机器人发展火爆,摩根士丹利预测到2050年产业规模或超5万亿美元。但机器人领域安全复杂,研究团队用CAI框架对三款消费级机器人渗透测试,揭示严重安全问题,且行业整体对安全无知。

AI与安全
产品应用8

震惊海外开发者!BOSS直聘3B小模型比肩80B,怎么做到的?

BOSS直聘楠北阁团队发布3B轻量端侧小模型Nanbeige4.1-3B,性能震惊海外开发者。团队从多方面改进,如优化推理和偏好对齐,重构训练数据,采用多种强化学习算法,使其性能比肩大模型。

AIGC开放社区
新闻资讯7

MMLU已死?「人类最后考试」登Nature:全球AI模型集体不及格!

AI发展迅猛,现有基准测试难以跟上其步伐。近1000名研究人员组成的全球联盟创建「人类最后的考试」(HLE),涵盖多领域难题,目前最强AI准确率不足50%,凸显AI与人类专家的差距。

新智元
新闻资讯8

吴恩达复盘百度岁月:我带过的自动驾驶、智能音箱都成了!Altman 我也带过,但 Gemini 3 比 ChatGPT 强

吴恩达团队提出新版图灵测试界定 AGI,避免行业泡沫。在播客中他还谈及 AI 关键议题,指出 AGI 短期难实现,规模化非唯一路径,AI 不会大面积取代岗位,中美 AI 各有优势等。

AI前线
开源动态8

小米的首代机器人VLA大模型来了!丝滑赛德芙,推理延迟仅80ms丨全面开源

具身机器人成科技新热点,大家期待其释放生产力。小米首代具身VLA大模型Xiaomi - Robotics - 0抓间歇停顿问题,4.7B参数规模下推理延迟仅80ms,还做三项技术创新,且全面开源。

量子位
算法论文8

清华联手千问重塑归一化范式,让 Transformer 回归「深度」学习

Pre - Norm和Post - Norm是Transformer架构中稳定信号流的关键范式,但面临权衡取舍。近日,清华黄高团队联合千问团队提出SiameseNorm,构建参数共享的平行通路,实现稳定训练并提升性能。

机器之心
8

挺意外的,Agent长期记忆潜力被AMemGym挖出来了

论文提出交互式在线策略评测框架AMemGym,它能反映AI助手长期记忆能力、驱动Agent自我进化记忆。它以结构化状态演化为骨架支撑自由对话评测,还对主流记忆系统做了扫描,带来评估与训练范式转换。

PaperAgent
开源动态8

阶跃新模型快到“没推理”!印奇上任,果然气势一新

印奇上任后,阶跃星辰发布新一代开源Agent基座模型Step 3.5 Flash,总参数196B,支持256K上下文窗口。它推理快,适配多家芯片厂商,在多场景表现出色,还具备端云协同能力,架构也有多项优化。

量子位
产品应用8

5年博士1年读完,20分钟干完48小时教授工作!这个工具在硅谷火了

新智元报道,Claude Code正重新定义编程。顶级开发者用它写代码,零基础小白10分钟做出App,教授20分钟完成48小时工作量。它理解项目上下文,自动设计、生成、测试代码,普通人用自然语言提需求即可。

新智元