测试框架」共找到 3119 篇相关文章

新闻资讯9

光计算如何走向实际部署?清华、上交提出光计算走向实用化的技术路线图

传统电子计算算力遇瓶颈,光计算成为下一代算力新方向。清华与上海交大研究团队联合在Nature Nanotechnology发表研究,提出国际首个光计算实用化统一评价框架与技术路线图,为光计算落地部署提供明确指导。

DeepTech深科技
开源动态8

超越VLA与世界模型,银河通用发布LDA,全谱系数据跑通Scaling Law

近期具身智能领域竞争激烈,银河通用联合多机构发布 LDA-1B 模型,能统一利用各类具身数据。它在基准测试中表现出色,代码已开源,还解决了数据格式、质量等问题,实战效果也很突出。

机器之心
算法论文7

现实世界的天气能复刻?Weather-Magician实时渲染下雨打雷下雪

传统工业方法在还原复杂现实场景时成本高、质量差,当前算法也难重建和渲染真实天气效果。上海交通大学提出Weather - Magician框架,能重建场景并渲染4D天气效果,对硬件要求低且可实时渲染。

带你学AI
新闻资讯7

GPT Image 2研究科学家陈博远:我在OpenAI修中文

GPT Image 2发布引发AI圈震动,主力训练者陈博远分享幕后故事。他和奥特曼同台主持,修好中文渲染,给模型起代号“布基胶带”,还设计多种“彩蛋级”测试,抖出官网图片幕后花絮。

量子位
开源动态7

你的「龙虾」真记得你吗?剑桥发布长期个性化记忆基准ATM-Bench

剑桥大学团队开源面向AI个人助理的长期记忆基准测试ATM - Bench,评估AI面对真实生活数据时能否「记住你」。实验结果不佳,专用和通用智能体系统准确率低,凸显长期个性化记忆问答难题。

机器之心
算法论文8

终于学会“复盘”了!让智能体从“解题”进化到“进化”!

上海AI Lab和新加坡国立大学推出新框架RETROAGENT,让AI Agent学会“复盘”。它通过双重内在反馈复盘,提出SimUtil - UCB策略查记忆,在多项任务中碾压基线模型,使Agent从解题进化到进化。

深度学习自然语言处理
开源动态8

微软开源新版Phi-4:推理效率暴涨10倍,笔记本可运行

今天凌晨微软官网开源Phi - 4家族最新版Phi - 4 - mini - flash - reasoning,它参数小性能强,适合边缘设备。采用自研SambaY架构,推理效率涨10倍,延迟降2 - 3倍,多场景测试表现优异。

AIGC开放社区
算法论文8

ICML 2025|趣丸研发新型人脸动画技术,声音+指令精准控制表情

广州趣丸科技团队提出新颖肖像驱动框架Playmate,能根据音频和控制条件生成高质量肖像视频,精准控制表情和姿态。成果被ICML 2025收录,代码开源筹备中,在多方面优于现有方法。

机器之心
开源动态8

GPT-4o连验证码都解不了??SOTA模型成功率仅40%

MetaAgentX团队推出Open CaptchaWorld平台,用于测试Agent解验证码能力。实测SOTA多模态模型成功率低,如GPT - 4o也被难住。该平台特点多样,揭示了当前Agent短板及模型设计新方向。

量子位
算法论文8

中国团队让AI拥有「视觉想象力」,像人类一样脑补画面来思考

上海交通大学等团队提出 Thinking with Generated Images,让大模型像人类一样用「脑内图像」推理。该研究区分三种视觉思维模式,提出核心技术框架,解决视觉推理局限,实验效果好,未来有望在多领域突破。

机器之心