结构化实验」共找到 2314 篇相关文章

算法论文8

大模型Agent的下一阶段:可自我进的AI-Agent

在人工智能飞速发展下,研究者探索让AI自我反思改进。本文作者构建自我进AI智能体系统,设计四层渐进式架构,经《卡坦岛》实验,证明自我进能力,不同模型表现有差异,代码级进潜力惊人。

AINLPer
算法论文7

AI能否「圣地巡礼」?多模态大模型全新评估基准VIR-Bench来了

来自日本高校和企业团队提出多模态大模型评估基准 VIR-Bench,用于评测 AI 对旅行视频中地理位置与时间顺序的理解。它将任务拆解,构建数据集,实验显示模型虽有改进但性能远未达标,指明了大模型进方向。

机器之心
开源动态8

不止动起来:SentiAvatar重新定义3D数字人动作生成范式

AI 初创公司 SentiPulse 联合团队提出 3D 数字人动作生成新范式 SentiAvatar,打造虚拟角色 SUSU,其框架等已全球同步开源。它解决了高质量数据荒等问题,实验表现优,还实现快速动作生成,支持流式交互。

机器之心
新闻资讯7

真实音频场景,大模型集体挂科!首个原生语音基准MultiChallenge

Scale AI发布首个原生音频多轮对话基准Audio MultiChallenge,撕开大模型靠合成语音评测维持的假象。实验显示,Gemini 3 Pro等模型在真实场景表现不佳,还揭示了模型在语音交互中的三大失败模式。

新智元
新闻资讯8

14岁华人小孩,折个纸成美国天才少年

14岁华裔少年Miles Wu(吴迈尔斯)凭借创新折纸设计获JIC最高奖,奖金2.5万美元。他提出新型三浦折纸变体,能承受自重1万倍以上重量,还想设计应急避难所。他无导师和平台,在家手搓实验夺冠。

量子位
产品应用7

从Sora2到TapNow:AI视频创作,差的是这套专业流程

国内知名导演欧阳英豪用AI打造百万级商业TVC,TapNow公开其创作流程。当下AI视频工具强,但能用于商业的TVC少,核心问题是不懂专业流程。TapNow将专业流程工具,有五大核心功能,适合不同层次创作者。

花叔
新闻资讯7

OpenAI内部路线图精简纯享版

这是OpenAI内部路线图精简版,包含自动AI研究员目标、五层安全策略、产品向平台与AI云迈进等内容,还涉及算力投入、新公司结构、非营利组织资本部署及科学发现时间表。

AI寒武纪
算法论文8

RLPT:腾讯混元在预训练数据上实现自主强学习

腾讯混元团队发布RLPT,是在预训练数据上应用强学习的方法,可突破大语言模型扩展瓶颈。它能让模型自主学习推理能力,无需人工标注,在Qwen3 - 4B - Base模型实验中性能显著提升。

AI工程化
算法论文8

Hyperagents:AI学会如何自我改进

近日,Meta发布Hyperagents论文引关注。它尝试解决AI能否自我改进改进方式的问题,核心创新是‘元认知自我修改’,实验在多领域表现出色,还涌现元级别改进且能跨领域转移,但有安全风险。

AI工程化
算法论文8

解决智能体手工构造难题! 浙大&腾讯提出 ReCreate,从零自动构建领域智能体

浙大、腾讯等机构研究者提出ReCreate框架,不依赖手工设计,让智能体自主构建。它从交互经验中找优方向,有三重设计,实验显示能提升多领域任务通过率、降成本,未来或开启AI“自我制造”时代。

AI科技评论