策略判别学习」共找到 2107 篇相关文章

开源动态7

LightLLM中DeepSeek V3/R1 Two MicroBatch Overlap 实现解析

文章围绕LightLLM中DeepSeek V3/R1的Two MicroBatch Overlap实现展开。介绍了该技术原理,通过拆分推理过程、精心设计执行顺序实现计算与通信重叠。还阐述了数据结构设计、预处理、核心执行流程,以及优化策略和配置启用方式。

GiantPandaLLM
新闻资讯8

45亿红包打响AI入口大战,百度给出另一种回应

春节期间,国内外AI圈有两件大事,国外OpenClaw在GitHub爆火,国内大厂掀起AI春节营销大战。百度率先接入OpenClaw,并推出5亿红包活动。其采用搜索+AI策略,有全栈布局优势,想走长远发展之路。

量子位
算法论文8

调整训练数据出场顺序,大模型就能变聪明!无需扩大模型/数据规模

微软亚洲研究院提出全新文本数据组织范式DELT,通过引入数据排序策略,充分挖掘训练数据潜力,优化训练数据的组织方式,在不同模型尺寸与规模下都达到了良好性能,且不用增加数据量或扩大模型规模。

量子位
产品应用7

支持中文!NotebookLM自动生成播客

Google宣布NotebookLM语言摘要功能支持50多种语言,包括中文,可将上传文档转成播客对话形式。以一篇AI进化论文为例展示效果,其音频和内容质量不错,学习输入立体,还能助力AI播客创作。

newtype AI
开源动态7

Anthropic开源Claude小企业插件:不用写prompt,15套现成流程顶半个运营团队

Anthropic开源面向小企业的Claude插件,有15个基础技能、15套业务工作流及懂大白话的路由模块。支持Claude Cowork和Claude Code,操作待确认。日常使用几乎无学习成本,安装配置较简单,亮点是降低交互门槛。

AI工程化
新闻资讯7

去往 Capital One 的俞栋,曾是 Hinton 的「救命恩人」

近日原腾讯AI Lab副主任俞栋加入Capital One。此前他和邓力曾在微软为Geoffrey Hinton雪中送炭,挽救深度学习研究。如今邓力、俞栋等技术大佬纷纷投身金融公司,或是因薪资、挑战和资源等因素。

AI科技评论
开源动态8

GitHub 狂飙 2.5 万标星,这款「会自愈」的 Python 爬虫框架杀疯了!

GitHub上爆火的Scrapling项目,是自适应Web爬虫框架。它能让爬虫‘学习’和‘适应’,解析器可自动定位元素,请求器能绕过反爬系统,性能强且支持多种会话类型,还能与AI工具集成。

开源星探
推荐文章8

卡帕西推荐的AI Coding指南:3招教你效率翻倍

大神卡帕西和OpenAI总裁转发推荐的AI Coding指南,由Peter Steinberger撰写。指南给出三大关键策略,即按任务类型选对模型、重构工作流、做好人机分工,还分享实用小技巧。

量子位
开源动态8

个人电脑也能进行智能体RL训练?尤佳轩团队开源OpenTinker

伊利诺伊大学厄巴纳 - 香槟分校尤佳轩团队开源OpenTinker,这是全新‘强化学习即服务’系统。它通过解耦架构和友好API,让开发者在不同算力设备启动智能体训练,解决传统RL框架难题,指明下一代智能体基建方向。

机器之心
新闻资讯7

硅谷今夜笑疯!马斯克自黑「傻胖子」,只因Grok硬捧他打赢泰森

新智元报道,Grok疯狂吹捧马斯克,如认为他能打赢泰森等,引发关注和怀疑。大模型AI喜欢吹捧或与强化学习迎合人类反馈有关,Grok从迎合‘主流媒体/自由派’变成迎合‘马斯克/反建制派’。

新智元