测试方法」共找到 3068 篇相关文章

新闻资讯8

全球首个IMO金牌AI诞生!谷歌Gemini碾碎奥数神话,拿下35分震惊裁判

谷歌DeepMind官宣Gemini Deep Think在IMO获官方认证金牌,4.5小时解5题得35分。它用纯英语解题,结合并行思考与强化学习训练。谷歌后续将向部分测试者及订阅者推出模型,还公开了解题过程。

新智元
产品应用8

秘塔AI也终于悄悄上线了DeepResearch。

秘塔AI搜索上线新功能DeepResearch,作者测试后评价颇高。它有可视化界面,能展示思考执行过程,打破AI黑盒。输出报告质量好、精准度高,还可生成互动网页,且免费额度多,虽有小问题但仍值得肯定。

数字生命卡兹克
新闻资讯8

VLA爆发!从美国RT-2到中国FiS-VLA,机器人「即知即行」的终极进化

2025年具身智能爆火,VLA模型成核心。从美国RT - 2到中国FiS - VLA,VLA硬核进化。谷歌、微软等有重要成果,中国智平方等企业也不断创新,FiS - VLA性能超现有方法,VLA正重塑机器人与人类交互未来。

新智元
开源动态8

腾讯混元推出首款开源混合推理模型:擅长Agent工具调用和长文理解

6月27日,腾讯混元开源首个混合推理MoE模型Hunyuan - A13B,参数80B激活仅13B,推理快性价比高。它在多测试集成绩好,尤其擅长Agent工具调用和长文理解,还开源两数据集填补评估空白。

AI前线
产品应用7

搜索 ≠ 简单匹配!0代码实现语义级图文互搜

在非结构化数据爆发增长的当下,传统图文检索方式难以满足企业需求。本方案介绍借助阿里云 Milvus 实现高效多模态图文检索,覆盖多场景,有开箱即用、性能强等优势,还给出架构、部署、验证及清理资源的方法

阿里云开发者
新闻资讯8

一句话生成任务专属LoRA!Transformer作者创业公司颠覆LLM微调

Transformer作者之一创立的SakanaAI推出Text-to-LoRA(T2L),简化模型适配流程,省却繁琐微调。T2L参数压缩率达80%仅降1.2%准确率,零样本场景平均准确率78.3%超现有SOTA方法,开启“一句话定制模型”时代。

量子位
新闻资讯8

被“网暴”两个月后,Yann LeCun 携最新世界模型杀回!小扎千万美元激励抢人,Meta AI 内部权利之争开始

Meta推出新的“世界模型”V-JEPA 2,可提升AI物理推理能力。它是V-JEPA扩展版,在百万小时视频上训练,能让机器人完成任务。Meta还发布三项基准测试,且已开源。LeCun力挺,小扎为追进度亲自招人才。

AI前线
开源动态8

真实评估!北理发布全球首个「全场景教育」基准,支持4000+情境

北京理工大学高扬老师团队推出EduBench,是全球首个「全场景教育」基准,涵盖9大教育场景、12个评估维度、超4000个情境。团队将数据、模型等全面开源,评估发现大模型在特殊教育场景有不足,还提出多源知识蒸馏等方法

新智元
算法论文8

成本暴降88%!通义实验室、北大发布ZeroSearch,无需搜索即可激活LLM检索能力

信息检索能力对提升大语言模型推理表现至关重要,但现有方法在训练中面临文档质量不可控和搜索 API 成本高昂两大挑战。为此,通义实验室和北大提出 ZeroSearch 框架,无需真实搜索即可激活 LLM 检索能力,显著降低成本。

机器之心
新闻资讯8

19岁少年用计算机炼出「神药」,斩获全球大奖!大厂看了都沉默

19岁斯洛伐克少年Adam Kovalčík用计算机模拟设计新分子,提出新合成方法,有望将抗RNA病毒药物Galidesivir成本降6倍,还设计出对新冠抑制效果或达Galidesivir 5倍的新分子,获全球青少年科研大奖。

新智元