善意的混乱」共找到 10457 篇相关文章

算法论文8

TACL 综述 | 别只卷架构了——长文本模型能力天花板,其实是数据决定

该 TACL 综述首次从数据视角审视长上下文语言模型,指出长上下文能力本质是数据驱动。它建立分类体系,明确高质量长文数据条件,给出核心能力数据配方与评估法,还整理数据集和基准,提出待解问题。

深度学习自然语言处理
新闻资讯7

为什么你 Agent 总是出故障?从算力基建到可信熔断架构生死线 | 直播预告

本次直播集结值得买、商汤、明略三位技术专家,拆解可信 Agent 构建之道。将探讨大模型基础设施、可信 Agent 架构、MCP 协议实战等内容,还会解答观众提问。

InfoQ
产品应用7

700 美金买“真情”?AI情感类产品爆火背后:卖不止是陪伴,而是年轻人孤独

本文讲述林悦依赖AI情感陪伴应用故事,指出当下AI情感陪伴类产品受欢迎,如字节‘显眼包’、卡西欧Moflin。分析市场大原因,探讨核心价值、产品设计、商业模式等,也提及行业挑战。

AI前线
算法论文8

HaluMem:让AI记忆系统“幻觉”现形——首个面向记忆系统操作级幻觉评测基准

过去一年,AI Agent‘记忆能力’成热门话题,但AI记忆存在幻觉问题。为此发布操作级幻觉评估基准HaluMem,它能精准定位幻觉来源,评估主流记忆系统,为构建可靠记忆系统提供方向。

PaperAgent
推荐文章7

红杉资本:服务,新时代软件

红杉资本 Julien Bek 文章探讨 AI 将“服务”转变为“软件”趋势。指出下一个万亿美金公司或为“服务”外衣软件公司,分析智力与判断力、副驾驶与自动驾驶等,还给出机遇地图及典型公司案例。

投资实习所
开源动态7

AI AgentsDeepSeek顿悟时刻:AutoHarness

文章介绍开源项目「Aha」— AutoHarness,这是面向AI Agent自动化Harness Engineering轻量级治理框架,能让智能体迎来顿悟时刻。对比了其与LangGraph、OpenAI SDK能力,还给出核心架构、安装及使用示例。

PaperAgent
开源动态8

微软prompt压缩方案-LLMLingua,开源

使用大语言模型时,提示信息长会致运行慢、费用高、易超限。微软推出LLMLingua可压缩提示信息,有完整开源。它历经多版本演进,还能用于安全防御,使用简单,值得开发者跟踪。

AI与安全
开源动态8

Agent RL和智能体自我进化关键一步: TaskCraft实现复杂智能体任务自动生成

当前智能体训练缺高质量任务数据,主流数据集依赖人工标注,规模和复杂性受限。OPPO 研究院提出 TaskCraft 框架,能自动生成智能体任务,构建并开源含约 41,000 条任务数据集,支撑智能体训练评估。

机器之心
开源动态7

The Batch:829 | DeepSeek 是怎么做到

DeepSeek 去年末以低成本训练出先进开源大模型引关注,近日团队披露构建 DeepSeek - R1 和 DeepSeek - V3 软硬件方案,降低内存和计算需求,其细节公布让更多团队有机会参与前沿研发。

DeeplearningAI
开源动态8

蛋白质基座GPT时代来了?!

清华大学周浩课题组联合上海人工智能实验室发布蛋白质基座模型AMix - 1,以系统化方法论构建,实现蛋白质基座领域从BERT到GPT时代跨越,有四大‘超能力’,设计蛋白活性提升50倍,代码等已公开。

量子位