大模型评估」共找到 9355 篇相关文章

产品应用8

数学奥赛高分摘金,位列模型榜首,『书生』科学多模态模型Intern-S1能力再升级 | 通专融合新进展

2025年CMO决赛首设AI测试,书生科学多模态模型Intern-S1以102分位列模型得分榜首,远超金牌线和国家集训队入选线。其推理能力提升得益于多项创新,未来将拓展至多领域科研。

OpenMMLab
算法论文8

模型顿悟原理!Meta新论文说清楚了

Meta超级智能实验室(FAIR)最新论文把模型顿悟(grokking)现象的数学机制说清楚了。提出Li2数学框架,将两层神经网络的grokking动态分三阶段,还推导了泛化缩放定律等。

AI工程化
新闻资讯7

亚马逊发布新AI模型,部署机器人突破100万

全球电商、云计算巨头亚马逊宣布推出新AI基础模型Deep Fleet,部署机器人超100万。该模型可提升机器人车队出行效率,还能协调机器人移动,带来交付快、成本低等好处。

AIGC开放社区
新闻资讯7

印度国家级模型上线两天仅 300 余次下载,投资人直呼“尴尬”:韩国学生模型都有20万!

印度 Sarvam AI 发布国家级模型 Sarvam - M,虽被赞为本土 AI 突破,支持 10 种本地语言,但上线两天仅 334 次下载,投资人批其成绩尴尬,还与韩国学生模型对比,引发社区争论。

AI前线
算法论文8

0.005%参数量超越SOTA!提升模型能力无需庞奖励模型

上海交通学等校联合团队提出轻量级奖励模型SWIFT,利用模型隐藏状态线性特征,仅训练极小线性层,在推理任务中超越主流奖励模型,实现计算效率与准确率双提升,且在多领域表现出色。

AIGC开放社区
开源动态7

香港科技学、Manycor开源空间模型,超3000颗星

香港科技学、Manycore联合开源空间模型SpatialLM,用于处理3D点云数据。它结合点云特征提取、对齐和语言生成,实现高效转换。研究团队经多种尝试选定基于点的方法及Sonata编码器,还选Qwen2.5 - 0.5B为基础模型

AIGC开放社区
技术实践8

RTP-LLM 在相关性模型中的推理优化最佳实践

淘宝搜索场景引入参数LLM模型,面临系统性能挑战。本文分享基于RTP - LLM框架的优化实践,如BatchSize调度、批次内前缀复用、MoE Kernel动态调优等,还提及未来优化方向。

阿里云开发者
算法论文8

Tool-Star:赋予模型结合多工具推理的能力

文章提出Tool - Star框架,旨在解决模型多工具协作推理难题。它从数据端到训练流程优化,让模型调用多种工具,在复杂计算和知识型推理任务表现卓越,还探讨了未来多模态及多工具扩展方向。

PaperAgent
算法论文8

The Batch:841 | 语言模型正在纠正历史遗留的不公

美国北加州旧不动产契约含种族歧视条款,虽已非法但人工筛查耗时久。斯坦福和普林斯顿研究团队微调语言模型识别圣克拉拉县契约中的歧视条款,模型可理解上下文,结果经律师确认,研究成果已开源。

DeeplearningAI
推荐文章7

模型的第一性原理:(二)信号处理篇

本文从信号处理角度解读模型原论文,探讨语义向量化原理,分析 Transformer 与 Granger 因果关系。指出模型输入 Token 语义嵌入是将自然语言处理转化为信号处理问题,向量化与信号处理、信息论联系紧密。

机器之心