结构化评估」共找到 1779 篇相关文章

算法论文7

4D空间智能:AI如何一步步「看懂」时空结构?一篇综述解析通往四维世界的五大层次

4D空间智能重建整合静态场景与时空变,构建含时间维度的空间表征系统。南洋理工等高校研究者调研该领域,提出按建构深度分五层的新视角,展现AI认知从基础到高阶的进路径。

机器之心
算法论文8

ACL 2026 | OPeRA Dataset: LLM真的能模仿人类行为了吗?首次系统评估LLM的人类行为模拟能力

美国东北大学等机构研究者提出OPeRA数据集,采集真实用户在线购物行为,支持系统评测LLM个体行为预测能力。实验显示当前主流LLM在模拟人类行为上表现有限,揭示其能力边界。

机器之心
算法论文7

JCP | 浙江大学边鑫等:基于 PINNs 的非结构自适应网格细:面向稳态流动的残差驱动 AMR 新方法

本文提出利用控制方程残差引导网格细的启发式策略,用物理信息神经网络(PINNs)整合粗网格数据与控制方程。通过解决流动问题并与传统方法对比,显示该策略能平衡计算精度与成本,但有额外计算开销。

力学与人工智能
开源动态8

狂揽17.1K Star!!开源逆向工程神器,Rizin引擎驱动、跨平台调试反编译、图形操作,爽翻了!

在信息安全等领域,传统逆向工具价格贵或操作复杂。开源君分享免费开源逆向工程神器Cutter,由Rizin框架驱动,有强大功能与现代界面,在GitHub获17.1K Star。

开源先锋
算法论文8

CVPR 2026 Oral|告别模型合并冲突!南大等提出OrthoReg:极简正交正则,揭开任务算术的底层机制

南京大学等团队为任务算术建立底层理论框架,提出「任务特征特」属性,推导出几何约束方法OrthoReg。该方法引入极简正交正则项,提升模型合并性能,论文被CVPR 2026接收并评为Oral,代码等已开源。

机器之心
算法论文8

演讲生成黑科技,PresentAgent从文本到演讲视频

联合团队提出 PresentAgent,能将长篇文档转为带解说演示视频。采用模块流程,还引入 PresentEval 评估框架。实验显示其接近人类表现,优于现有方案,展现了多模态智能体潜力。

机器之心
开源动态7

Kimi K2基于DeepSeek V3构建

从Hugging Face模型配置文件可知,月之暗面未设计全新模型结构,而是选Deepseek V3作基座模型,用自身高质量数据、独特方法做大量‘微调’和‘后训练’。

AI寒武纪
开源动态8

2小时入门「个性联邦学习」,上交清华开源斩获1700+星 | JMLR'25

上海交通大学和清华大学研究人员开源个性联邦学习代码库PFLlib,含39种算法、3种场景和24个数据集,支持模拟500设备训练,还有隐私保护评估工具,降低研究门槛。

新智元
新闻资讯7

国产算力正在进入Token标准时代

2026年6月17日,是石科技攒局国产异构算力创新发展论坛。其创始人闫博文认为国产算力瓶颈在工程能力。是石科技正将异构算力转为标准Token生产能力,还启动B轮融资。

量子位
新闻资讯7

AI实力榜大洗牌!OpenAI谷歌强势领跑,Anthropic节节败退

Poe最新报告显示,2025年1 - 5月AI各领域市场份额大洗牌。OpenAI和谷歌势头猛,Anthropic掉队。文本生成、推理、图像等各领域竞争激烈,企业需搭建评估体系,按需选模型。

新智元