自证能力」共找到 4064 篇相关文章

开源动态8

能让DeepSeek进化的Harness!LlamaFactory作者开源新工具:0.2元动造Agent

LlamaFactory作者郑耀威团队开源的PenguinHarness,是全球首个支持多Agent进化的Harness,能动构建、评测和改进Agent。它成本低、速度快,适配众多模型,还有严格契约保障安全。已在生产场景应用,效果显著。

机器之心
算法论文8

大模型能力,小模型成本!Google等 | 提出递归混合框架:MoR, 大幅提升LLM计算效率

Google提出递归混合框架(MoR),融合参数共享与适应计算。它有轻量级路由和KV缓存策略,在不同路由机制各有优劣。实验显示,MoR在性能、计算和内存效率上表现出色,有望实现“大模型能力,小模型成本”。

AINLPer
开源动态8

打破AI能力的惯性评估方式,红杉中国推出全新双轨基准测试xbench|甲子光年

红杉中国推出全新AI基准测试工具xbench,采用双轨评估体系,构建多维度测评数据集,追踪模型理论能力上限与Agent实际落地价值。还采用长青评估机制,首期发布两个核心评估集并给出综合排名,公开后邀各界完善。

甲子光年
新闻资讯7

语言模型内部还藏着众多策略模型?底向上强化学习重塑底层特征 | 直播预约

现有强化学习工作将语言模型作整体策略优化,研究提出以策略视角审视内部隐藏状态,分析层级和模块级策略,发现不同模型模式差异,还提出底向上强化学习策略,为研究架起新桥梁。

深度学习自然语言处理
推荐文章7

数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图

文章借Snowflake分享,探讨数据从业者在AI时代的核心能力。介绍AI从工具到执行者的进化,指出数据叙事成稀缺技能,还给出普通职场人90天AI逆袭路线图,强调人类在决策判断上的不可替代性。

InfoQ
算法论文8

回归更灵活、比离散扩散更通用,首个纯Discrete Flow Matching多模态巨兽降临

近年来多模态大模型多采用回归架构,推理缺乏灵活性。香港大学和华为诺亚方舟实验室研究团队提出FUDOKI,基于全新非掩码离散流匹配架构,能并行去噪、动态修正,为多模态模型开辟新路径。

机器之心
新闻资讯7

35 年只卖设计,今天亲下场造芯!Arm 首款研芯片发布,Meta 抢下首单

36 年来 Arm 一直授权芯片设计,如今推出首款研芯片 Arm AGI CPU,Meta 成首单客户。该芯片专为代理式 AI 设计,性能出众,获多家企业认可,还推出参考服务器,当前全球 CPU 供应趋紧。

AI前线
算法论文8

北大联手通义实验室发布ZeroSearch:成本暴降88%,无需搜索即可激活大语言模型的检索能力

北大与通义实验室发布ZeroSearch框架,可无需真实搜索激活大语言模型检索能力。它引入大语言模型模拟搜索、采用结构化模板等策略,成本降88%,多项实验显示其性能超越基线与真实搜索方法。

深度学习自然语言处理
新闻资讯8

只收AI人才,OpenAI认直通大厂!全球首个AI招聘平台,1000万人持上岗

OpenAI宣布上线就业平台,推出AI技能认,目标在2030年前让1000万人持上岗。沃尔玛率先参与,白宫亲背书。该计划旨在用AI解决就业冲击,将AI技能认推向新高度。

新智元
开源动态8

QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5

通义文档智能团队推出QwenLong - L1.5,提供长文本推理后训练“配方”,含数据合成管线、强化学习方法和智能体架构。通过三大“法宝”重塑模型能力,效果显著,相关代码已开源。

AINLPer