「用户偏好数据」共找到 3778 篇相关文章
Reasoning模型可以Self-Train!
当前大模型依赖人类标注数据,成本高且扩展难。论文探讨模型自我纠错、自主进化可能,提出自我奖励训练(SRT),用投票共识代替人类标注。在数学数据集上有效果,但高难度数据集出现问题,作者给出解决办法并开源代码。
对话百度文库:不做大模型能直接做的事,能力积累换来竞争壁垒|AI产品Time
百度文库从文档检索平台转型为一站式AI内容获取和创作平台,付费用户超4000万,AI MAU近亿,智能PPT访问量全球第一。访谈中,负责人分享产品理念、优势及运营经验,如不走大模型能直接做的事,从用户需求出发开发功能等。
The Batch: 898 | Copilot 用户需求随时间变化
微软研究表明,人们在深夜用手机和工作日白天用笔记本电脑时,对Copilot使用方式不同。研究分析3750万次对话,发现主题和意图因设备、时间、年份而异,AI社群或需重新考虑聊天机器人设计。
AI数据工程师在应用中如何"返璞归真"
文章反思‘知识库+Prompt工程+工具调用’轻量级Agent构建模式局限,指出其难应对知识质量、语义理解与规模化维护挑战。提出从‘Prompt驱动’到‘上下文工程’、从‘搭积木组装’到‘全链路闭环’的范式跃迁,并介绍MktAI知识体系建设。
2025 年 InfoQ 趋势报告:AI、ML 和数据工程
InfoQ AI ML 趋势报告基于编辑团队与嘉宾播客,总结 AI、ML 技术发展趋势。涵盖 AI 代理、多模态语言模型等创新领域,也提及早期采用者、早期多数、晚期多数类别的技术,还对 2025 年相关领域发展作出预测。
理解Ray Data分布式数据处理原理-源码分析
Ray Data是构建于Ray之上的分布式数据处理库,提供高性能且可扩展的API,可用于AI场景。文章从源码入手,分析其流式执行原理,包括读取数据源、构建数据处理、输出数据等环节,还介绍了LogicalPlan转PhysicalPlan及流式执行过程。
DeepSeek 复盘:128 天后,为什么用户流量一直在下跌?
文章深入分析DeepSeek和Anthropic策略,揭示行业计算资源稀缺难题。指出AI服务定价是延迟、吞吐量、上下文窗口三个指标的权衡,DeepSeek牺牲体验换研发,Anthropic提升‘智能密度’优化资源。
DMS Airflow:企业级数据工作流编排平台的专业实践
DMS Airflow 基于 Apache Airflow,集成阿里云 DMS 系统能力,为数据团队提供工作流调度等功能。文章介绍其高级编排能力、DMS 集成特殊能力及使用示例,总结核心优势与适用场景。
Common调查数据,72%美国青少年使用过AI伴侣
美国非营利组织Common Sense Media研究显示,72%美国青少年至少试过一次AI伴侣,52%为定期用户。研究还考察了使用行为、原因、感受等,如近半视其为工具,50%不信任其信息。
Anthropic发布AI就业冲击报告,数据让人意外
Anthropic发布AI对劳动力市场影响的报告,基于真实数据和理论智能分析。提出“观察暴露度”新指标,揭示AI理论能力与实际应用差距大,还给出高危职业排行,分析受影响人群、安全职业等。