「大模型测试」共找到 9855 篇相关文章

算法论文8

稳定训练、数据高效,清华大学提出「流策略」强化学习新方法SAC Flow

本文介绍清华大学和CMU提出的SAC Flow新方案,可端到端优化流策略。它将流策略视作residual RNN,用GRU和Transformer结构稳定训练。在多环境测试中表现优,有稳定、快速、样本效率高的特点。

机器之心
新闻资讯7

Forbes 报道:2.5 亿美元年化收入,硬件销量超百万,Plaud 是怎么赚钱的?

AI硬件创企Plaud创始人许高透露,公司年化收入将达2.5亿美元,约半数收入来自年度AI订阅服务。Plaud采用“深圳硬件+硅谷AI”模式,专注海外市场,以“硬件+软件订阅”盈利,同时面临大厂竞争。

Founder Park
产品应用8

顶级邪修倾囊相授!藏师傅教你速通Nano Banana

作者歸藏教大家发掘图片编辑模型Nano Banana潜力。它上线后可白嫖,让Adobe等修图软件失色。介绍使用方法、多种修图玩法及在电商、动漫修复等场景应用,称相关生意都值得用它重做。

歸藏的AI工具箱
新闻资讯7

靠AI破解癌症,初创公司融下3000万刀!新目标:建10亿单细胞数据集

福布斯介绍,初创公司Tahoe Therapeutics融资3000万美元构建活细胞AI模型,估值达1.2亿美元。该公司已研发出针对一种主要癌症亚型的候选药物,还开源数据集,与其他公司合作开发AI agent。

量子位
产品应用8

4K-Agent:可将低分辨率图像提升至4K高清智能体

图像超分辨率技术在多种视觉任务中重要,但传统方法泛化能力有限。德克萨斯A&M等大学研究人员推出4K Agent,其多智能体架构能将低分辨率图像提至4K高清,在多领域测试表现出色。

AIGC开放社区
产品应用8

社区供稿 | GLM-4.5技术博客:原生融合推理、编码和智能体能力

文章介绍 GLM-4.5 和 GLM-4.5-Air,二者旨在统一推理、编码和智能体能力。在 12 个基准测试中表现良好,采用 MoE 架构等技术,还开源 slime 框架。文中展示其多方面应用,并说明使用方式。

Hugging Face
算法论文8

综述 | 从“说出来”到“脑中算”:Latent Reasoning的范式跃迁与无限可能

大型语言模型用显式思维链推理有局限,潜在思维链(Latent CoT)让推理在连续隐藏状态空间进行。论文梳理该领域,建立框架,介绍方法,探讨可解释性与无限深度推理,指出价值、挑战与未来方向。

深度学习自然语言处理
新闻资讯8

刷新硅谷融资纪录!华人具身智能团队刚毕业融资过7亿元,平均年龄不到28岁

华人主导的Genesis AI公司成立仅一月完成1.05亿美元种子轮融资,刷新硅谷两项融资纪录。团队平均年龄不到28岁,靠开源的Genesis物理引擎吸引投资,致力于开发通用机器人基础模型和通用机器人。

量子位
新闻资讯7

40位数学家组成8队与o4-mini-medium比赛,6队败北

Epoch AI安排40位数学家组成8支战队,与OpenAI的o4 - mini - medium模型对决,考题来自高难度的FrontierMath数据集。结果AI以6:2击败人类,不过Epoch AI认为AI未明显超人类,但很快会达到。

机器之心
产品应用8

1w颗星!本地化视频翻译配音工具!

KrillinAI是多功能音视频本地化与增强方案,面向人类用户和AI Agent。它功能全,覆盖视频处理完整链路;特点多,支持CLI调用等;还兼容多种语音识别、大语言模型和TTS服务,可Docker部署。

GitHubStore