「数据集构建」共找到 4064 篇相关文章
基于LLM的Agentic Reasoning框架综述:从方面到场景的全面总结
近年来,大型语言模型虽能力强但有局限,研究者构建基于LLM的智能体系统。此综述论文提出系统、统一分类法梳理智能体推理框架,建立统一描述语言和通用算法,分析其在不同场景表现与评估方法。
首次结合RL与SFT各自优势,动态引导模型实现推理⾼效训练
新一代大型推理模型在复杂推理有进展,核心是ZERO - RL训练法。华为香港研究所小艺团队等合作推出GHPO算法框架,融合在线强化学习与模仿学习,解决了RLVR方法局限,提升模型训练效果,代码数据开源。
告别依赖地狱!新型Python打包神器,支持三种打包模式,跨平台,零配置!
分发Python应用时,环境配置和依赖管理让人头疼。刚开源的Python打包工具PyFuze功能全面,基于cosmopolitan和uv构建,有三种打包模式,兼容GUI应用,跨平台运行,还能一键将项目打包为单个可执行文件。
最新豆包、deepseek、元宝、夸克、千问、百度、文心、Kimi、微信搜一搜、抖音、小红书等AI搜索生成内容引用来自哪些地方?【干货】
作者白杨SEO指出,生成式人工智能发展快,AI搜索优化GEO受关注。介绍了豆包、DeepSeek等多个AI搜索生成内容引用来源,如豆包引用抖音、头条等,DeepSeek用开源数据等,还提及各平台优化要点。
工程知识引擎:Harness Engineering体系下的工程知识底座
现代软件开发中,AI编程智能体虽能写代码但难理解代码,缺乏工程约束与上下文支撑。为此构建工程知识引擎,整合多维数据源,有向量检索等六大能力,经评估可提升智能体效率与代码质量。
英伟达叫板DeepSeek?怒投260亿美元,要打造最强开源模型
英伟达已成为人工智能时代基础设施的一部分,2023年11月推出首个Nemotron模型进入通用大模型领域。未来五年将投260亿美元构建开源模型,还发布了性能最强的开源模型Nemotron 3 Super。
医生版 ChatGPT 3 年估值 60 亿美金,被低估的 AI 硬件新玩法:相框
OpenEvidence被称为医学领域的Google和医生版ChatGPT,成立3年估值达60亿美金。它用高质量数据训练小而专模型,有“无幻觉”机制,直接面向医生推广,产品进化为临床决策助手,收入来自制药广告。
一句话让数据库裸奔?Supabase CEO:MCP 天生不该碰生产库
安全研究团队警告,使用Cursor搭配MCP可能致SQL数据库泄露,攻击者靠一条信息就能实现。MCP被广泛接入,其配置问题成AI应用核心安全挑战。如Supabase MCP,攻击者用留言让Cursor代理复制私密表数据。
性能暴涨50%!谷歌、微软、OPPO 联手开源Agent “经验炼金术”
谷歌DeepMind、微软研究院、OPPO等机构开源`AGENT KB`项目,提出并实现“AI经验库”概念。它有“师徒模式”工作流,设计了从“原始日志”到“结构化经验”的构建流程,应用时分层调用知识,能让Agent性能飙升。
我们用飞书开了个选题会,一下进入现代化办公,编辑部直呼:真香
2025年飞书未来无限大会上,飞书发布和升级诸多产品。如达M3标准的知识问答,可秒搜文档;达M4标准的飞书会议,支持声纹识别。多维表格性能提升、应用构建升级,还有AI工具全家桶。