零样本设计」共找到 1735 篇相关文章

开源动态8

让AI当「动作导演」:腾讯混元动作大模型开源,听懂模糊指令,生成高质量3D角色动画

3D角色动画创作面临成本高、数据稀缺等问题。腾讯混元团队研发的混元Motion 1.0动作生成基础模型于2025年12月30日开源,通过全链路算法创新,为3D角色动画生成确立新技术范式。

量子位
新闻资讯8

刚刚,Anthropic分享了他们在AI Agents评估的最佳实践

Anthropic发布blog《揭秘AI Agents评估》,指出良好评估能助团队信心发布AI智能体,介绍评估结构、构建原因、评估方法、从到一的路线图,还提到评估需与其他方法配合,全面了解智能体性能。

PaperAgent
推荐文章8

认知重建:Speckit 用了三个月,我放弃了——走出工具很强但用不好的困境

本文作者分享使用 Speckit 三个月的踩坑经历,探讨 AI 编程工具落地难题。介绍复合工程与上下文工程理念,提出 AI 工程化方案,对比传统工具,阐述其设计、落地策略及未来趋势,助力解决企业开发痛点。

腾讯技术工程
开源动态8

让世界模型推理效率提升70倍:上海AI Lab用“恒算力”破解长时记忆与交互瓶颈

上海AI Lab联合多家机构开源Yume1.5,针对视频生成构建可交互“世界模型”的核心难题,提出时空信道联合建模(TSCM),实现近似恒定计算成本的全局记忆访问,展示了世界模型工程化落地的可行路径。

量子位
推荐文章8

创业者思考:如何做 AI Agent 喜欢的基础软件?

作者黄东旭指出Infra软件主要使用者正从开发者转向AI Agent,以TiDB Cloud为例说明趋势已现。他探讨如何做AI Agent喜欢的基础软件,从心智模型、接口设计、必要特征、商业模式等方面给出建议。

Founder Park
算法论文8

医疗AI迎来大考!南洋理工发布首个LLM电子病历处理评测 | AAAI'26

南洋理工大学研究人员构建EHRStruct基准,涵盖11项核心任务、2200个样本,用于评测LLM处理结构化电子病历的能力。研究发现通用大模型优于医学专用模型,提出的EHRMaster框架与Gemini联合后性能超现有模型。

新智元
新闻资讯7

打脸哲学无用!牛津博士教出Claude,自曝百万年薪提示词秘诀

Anthropic驻场哲学家Amanda Askell主导设计Claude的性格等机制,她分享制定有效AI提示词方法,认为需哲学思维。此外还提及不同人对提示词看法,以及大模型存在的「裂脑问题」。

新智元
开源动态8

上交×蚂蚁发布 DiagGym:以世界模型驱动交互式医学诊断智能体

上海交通大学与蚂蚁集团等团队提出新训练框架,构建面向医学诊断的世界模型DiagGym,训练诊断智能体DiagAgent,还设计评测基准DiagBench。实验显示该框架下的智能体表现优于先进模型,代码等已开源。

机器之心
产品应用8

AI时代的天工开物:分子之心掀起生物经济“操作系统”革命 | 甲子光年

生物经济正迈向工程化时代,分子之心作为AI蛋白质设计领军企业,携核心产品MoleculeOS入驻礼来上海创新孵化器。该平台升级后能力强大,还在构建生物经济‘新基建’,解决产业难题。

甲子光年
开源动态8

M2模型杀回Coding和Agent领域,MiniMax想要「普惠智能」

如今大模型竞争转向综合比拼,MiniMax 发布并开源 M2 模型,在权威测评跻身全球第一梯队。它定位轻量级,Coding 与 Agentic 能力强,性价比高,还升级 Agent 产品,以技术普惠策略让用户成本体验。

InfoQ