数据集构建」共找到 4064 篇相关文章

算法论文8

基于LLM的Agentic Reasoning框架综述:从方面到场景的全面总结

近年来,大型语言模型虽能力强但有局限,研究者构建基于LLM的智能体系统。此综述论文提出系统、统一分类法梳理智能体推理框架,建立统一描述语言和通用算法,分析其在不同场景表现与评估方法。

深度学习自然语言处理
算法论文8

首次结合RL与SFT各自优势,动态引导模型实现推理⾼效训练

新一代大型推理模型在复杂推理有进展,核心是ZERO - RL训练法。华为香港研究所小艺团队等合作推出GHPO算法框架,融合在线强化学习与模仿学习,解决了RLVR方法局限,提升模型训练效果,代码数据开源。

机器之心
开源动态8

告别依赖地狱!新型Python打包神器,支持三种打包模式,跨平台,零配置!

分发Python应用时,环境配置和依赖管理让人头疼。刚开源的Python打包工具PyFuze功能全面,基于cosmopolitan和uv构建,有三种打包模式,兼容GUI应用,跨平台运行,还能一键将项目打包为单个可执行文件。

开源星探
推荐文章7

最新豆包、deepseek、元宝、夸克、千问、百度、文心、Kimi、微信搜一搜、抖音、小红书等AI搜索生成内容引用来自哪些地方?【干货】

作者白杨SEO指出,生成式人工智能发展快,AI搜索优化GEO受关注。介绍了豆包、DeepSeek等多个AI搜索生成内容引用来源,如豆包引用抖音、头条等,DeepSeek用开源数据等,还提及各平台优化要点。

白杨SEO优化教程
产品应用8

工程知识引擎:Harness Engineering体系下的工程知识底座

现代软件开发中,AI编程智能体虽能写代码但难理解代码,缺乏工程约束与上下文支撑。为此构建工程知识引擎,整合多维数据源,有向量检索等六大能力,经评估可提升智能体效率与代码质量。

阿里云开发者
新闻资讯7

英伟达叫板DeepSeek?怒投260亿美元,要打造最强开源模型

英伟达已成为人工智能时代基础设施的一部分,2023年11月推出首个Nemotron模型进入通用大模型领域。未来五年将投260亿美元构建开源模型,还发布了性能最强的开源模型Nemotron 3 Super。

机器之心
新闻资讯8

医生版 ChatGPT 3 年估值 60 亿美金,被低估的 AI 硬件新玩法:相框

OpenEvidence被称为医学领域的Google和医生版ChatGPT,成立3年估值达60亿美金。它用高质量数据训练小而专模型,有“无幻觉”机制,直接面向医生推广,产品进化为临床决策助手,收入来自制药广告。

投资实习所
新闻资讯7

一句话让数据库裸奔?Supabase CEO:MCP 天生不该碰生产库

安全研究团队警告,使用Cursor搭配MCP可能致SQL数据库泄露,攻击者靠一条信息就能实现。MCP被广泛接入,其配置问题成AI应用核心安全挑战。如Supabase MCP,攻击者用留言让Cursor代理复制私密表数据

AI前线
开源动态8

性能暴涨50%!谷歌、微软、OPPO 联手开源Agent “经验炼金术”

谷歌DeepMind、微软研究院、OPPO等机构开源`AGENT KB`项目,提出并实现“AI经验库”概念。它有“师徒模式”工作流,设计了从“原始日志”到“结构化经验”的构建流程,应用时分层调用知识,能让Agent性能飙升。

探索AGI
产品应用8

我们用飞书开了个选题会,一下进入现代化办公,编辑部直呼:真香

2025年飞书未来无限大会上,飞书发布和升级诸多产品。如达M3标准的知识问答,可秒搜文档;达M4标准的飞书会议,支持声纹识别。多维表格性能提升、应用构建升级,还有AI工具全家桶。

机器之心