性能测试」共找到 3300 篇相关文章

新闻资讯7

谷歌训出Gemini 3的TPU,已成老黄心腹大患!Meta已倒戈

谷歌酝酿TPU@Premises计划,允许客户将TPU搬进自家数据中心,首个目标是Meta。谷歌Ironwood TPU v7与英伟达B200性能相当,还拥抱PyTorch拆解CUDA壁垒,欲夺英伟达10%市场份额。

新智元
开源动态8

Meta开源史上最强语音“基座模型”:一口气支持1600+种语言

Meta AI FAIR团队发布Omnilingual ASR模型套件,能为超1600种语言提供自动语音识别能力。它引入新架构提升性能,改变引入新语言范式,还发布相关数据集和模型,与全球伙伴合作。

AI寒武纪
产品应用7

Jina 第4版:多模态向量检索,统一适配,挑战3大任务

Jina第4版基于Qwen2.5 - VL模型扩展,支持单向量和多向量输出。它经对比学习和任务特化训练,推理时可按需选LoRA适配器,能利用多模态处理能力优化不同任务性能

CourseAI
开源动态8

GPT-4o连验证码都解不了??SOTA模型成功率仅40%

MetaAgentX团队推出Open CaptchaWorld平台,用于测试Agent解验证码能力。实测SOTA多模态模型成功率低,如GPT - 4o也被难住。该平台特点多样,揭示了当前Agent短板及模型设计新方向。

量子位
算法论文8

ICML 2026|让AI自动发现前沿风险:创智×复旦×牛津发布AutoControl-Arena

当AI智能体走向真实应用,前沿风险藏于复杂长尾场景,难以靠人工覆盖。创智、复旦、牛津联合发布AutoControl Arena框架,自动合成可执行测试环境,还构建X - BENCH验证,已在GitHub开源。

机器之心
产品应用8

Cursor 终于让你可以关笔记本了

昨夜,AI编程工具Cursor发布Agent云功能更新,解决本地运行占资源问题。可本地云端无缝切换,10分钟搭云端开发环境,有独立云子Agent隔离任务,iOS测试版上线,获用户认可。

AI工程化
新闻资讯8

放弃开源、重组权力!扎克伯格掏出Muse Spark,杀回大模型主桌

Meta在AI发展遇阻后推出Muse Spark,它是MSL首个模型,定位为通向个人超级智能的第一步,性能表现出色,当前闭源,未来Muse系列或有开源变体,标志Meta AI权力结构重塑。

AI科技大本营
新闻资讯7

训练机器人方式对了吗?英伟达DreamZero双榜第一新反思

NVIDIA的DreamZero在RoboArena和MolmoSpaces基准测试双登顶。分析文章《Why is DreamZero so good at robotics?》从多维度拆解其表现突出原因,质疑传统认知,如数据量并非万能,模型规模和信息输入方式也很关键。

机器之心
产品应用8

谷歌Alpha家族再登Nature封面!刷新基因组预测SOTA,精准定位远端致病突变

谷歌Alpha家族新成员AlphaGenome登Nature封面,将AI预测拓展到人类基因组图谱。它能综合预测11种基因调控过程,精准定位远端致病突变,性能超现有程序,已面向非商业研究开放API。

量子位
产品应用8

OpenAI 推出 GPT-5 驱动的安全卫士Aardvark:Codex 绝佳搭档

OpenAI推出由GPT - 5驱动的自主安全研究智能体Aardvark,用于软件安全保障。它能持续分析代码仓库,识别并修复漏洞,目前在内部及合作伙伴代码库效果良好,正处私有测试阶段。

AGI Hunt