可验证性」共找到 4874 篇相关文章

新闻资讯8

Karpathy最新预言:不开放、不脚本化的软件将在AI时代“灭绝”

Andrej Karpathy预言,不开放、不脚本化的传统软件在AI时代将‘灭绝’,他点名Adobe全家桶等软件风险高,认为未来赢家是‘天生文本化、脚本化’产品,软件‘AI协作’将成生死分水岭。

AI工程化
开源动态8

准确回答视频细节!11B模型挑战视频理解「证据级」任务,开源商用

近日,复旦大学邱锡鹏教授领衔的OpenMOSS团队联合模思智能开源11B参数的多模态视觉理解模型MOSS-VL。它能准确回答视频里验证的细节、时间、过程和空间关系,有六项证据级能力,架构设计独特,采用Apache2.0开源许

量子位
推荐文章7

“分身术”来了!MANA创作者扶持计划带你走进MUMA Island的未来分身实验

文章介绍数字时代“分身术”,它是身份与叙事实验。从概念源流到技术支撑展开阐述,MUMA Island打造“三式分身”创作矩阵,MANA创作者扶持计划重视该项目,有前沿复制和社会价值,还公布活动信息。

MANA新媒体艺术站
算法论文7

Meta最新大模型RL微调:在线DPO/GRPO显著优于离线DPO

Meta和NYU研究强化学习在大模型微调中的有效,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,多任务结合验证与不验证任务能提升能,还给出不同任务的测试数据。

PaperAgent
算法论文8

RL训练一层就够了!单层RL超越全参数训练,跨任务跨模型跨算法全部验证

明尼苏达大学、北大和亚马逊团队研究发现,RL收益集中在中间层,训练单层超全参数训练。他们提出层贡献度指标,经多模型、算法、任务实验验证,还给出三种训练优化策略。

机器之心
新闻资讯7

AI“读书”合法了:美法院最新裁定,无需作者同意,已购书籍用于训练AI

美国法院裁决允许Claude背后公司Anthropic,在未经作者许下用合法购买的已出版书籍训练AI,参考“合理使用”原则,认为属“转化使用”。此前也有类似AI版权诉讼案例。

量子位
推荐文章7

实战·Agentic 上下文工程(下):实现一个自我学习与进化的智能体原型

文章参考ACE论文架构与提示词设计,实现自我学习与进化的ACE智能体原型。介绍整体架构、各模块实现逻辑、工作流组装测试,也指出当前问题如LLM表现波动大等,并给出改进方向。

AI大模型应用实践
开源动态8

多模态Deep Research,终于有了「核验」的评测标准

俄亥俄州立大学与 Amazon Science 等联合发布 MMDR - Bench,将多模态 Deep Research 评估拉到核验标准。它含 140 个专家任务,覆盖 19 领域,把评估拆成 3 段管线、12 指标,强调过程证据链。

机器之心
新闻资讯7

大模型终于通关《宝梦蓝》!网友:Gemini 2.5 Pro酷爆了

Gemini 2.5 Pro在直播中通关《宝梦蓝》,谷歌CEO官宣。文中介绍其通关过程、玩游戏基本步骤,还探讨宝梦对大模型的挑战,谷歌将继续探索,网友提议用通关宝梦测试大模型 。

量子位
产品应用8

实测灵AI的新视频模型,它生成的动作戏酷到封神。

作者实测灵2.5新视频模型,它已灰度内测并登上釜山电影节。与灵2.1对比,灵2.5在运动和表演能力上大幅提升,还增强了文生视频与理解能力,让创作者有更多创作自由。

数字生命卡兹克