零样本扩展」共找到 913 篇相关文章

开源动态8

AI破译生命!微软蛋白质研究「超级加速器」登上Science

微软研究AI for Science团队推出BioEmu,能模拟蛋白质在平衡状态下的各种可能结构集合。它输入蛋白质序列就能生成大量结构样本,预测性质,速度比传统方法快10万倍,已开源助力药物研发。

新智元
开源动态8

The Batch: 849 | 用于训练网页智能体的生成数据

开发网页智能体常需大量人力标注训练样本,卡内基梅隆大学与亚马逊团队实现训练数据生成自动化。他们构建数据集,通过智能体工作流程生成数据,微调后 Qwen3 - 1.7B 表现出色,还公开数据与方法。

DeeplearningAI
算法论文8

ICML2025 | 揭示MLLM的图文联动推理能力

当前多模态大语言模型(MLLMs)在图文深度融合推理能力上面临挑战,现有评测基准无法真正检验该能力。EMMA基准应运而生,它从四大领域精选题目,采用双重过滤机制和细粒度标注体系,评测发现MLLMs存在多模态推理危机。

深度学习自然语言处理
算法论文8

奖励模型终于迎来预训练新时代!上海AI Lab、复旦POLAR,开启Scaling新范式

在大语言模型后训练阶段,奖励模型设计与训练是关键瓶颈。上海AI Lab、复旦推出预训练奖励模型POLAR,采用策略判别学习新范式,适配强化微调,性能和泛化能力强,为LLM后训练带来新可能。

机器之心
新闻资讯7

一文读懂:国产AI芯片与英伟达的差距有多大?

文章围绕国产AI芯片与英伟达的差距展开。从算力性能、生态壁垒、市场现状、技术瓶颈等方面分析差距,指出国产芯片虽在部分场景缩小差距,但高端训练和生态成熟度仍落后3 - 5年,突围需多领域突破。

芯师爷
推荐文章7

开始200行python代码实现LLM

文章从传统思路出发,用Python实现极简大语言模型,介绍从基础到Bigram模型的过程,包括词汇表、模型训练推理等内容,还讲解了PyTorch基础,最后实现pytorch版Bigram模型,后续将实现完整GPT。

阿里云开发者
算法论文8

北大团队发布首篇大语言模型心理测量学系统综述:评估、验证、增强

随着大语言模型(LLM)能力迭代,传统评估方法难满足需求。北大宋国杰教授团队论文首次系统梳理LLM心理测量学研究进展,革新评估原则,扩展测量构念与方法,还给出增强方法与未来研究方向。

机器之心
产品应用8

AI编码新神登基,藏师傅一手Claude 4实测

Claude 4低调发布,Anthropic称Claude Opus 4是全球最佳编码模型。发布内容含扩展思维、新模型能力等,还公布定价。Claude Opus 4编码和记忆能力强,实测表现出色,Claude Sonnet 4也有提升且免费。

歸藏的AI工具箱
新闻资讯7

为了「自我锤炼」,OpenAI 造了一个攻击力极强的「AI 黑客」

OpenAI宣布扩展网络安全计划Daybreak,推出GPT‑5.6‑Cyber,分蓝队和红队。红队模型模拟黑客找漏洞,能力强悍,高危安全任务完成率达95%。但此举也带来安全风险,OpenAI采取分级授权等措施。

AI科技评论
产品应用8

Meta首个Agent生图模型登场,空降竞技场第二

Meta超智能实验室推出图像生成模型Muse Image,引入智能体机制,能编写代码、网络搜索,有自主修正能力,支持算力扩展、多轮编辑与画面合成。还预览了Muse Video,两模型均与Meta产品深度整合。

AI寒武纪