可运行性」共找到 4669 篇相关文章

产品应用7

DeepInsight x ChatBI:个人Agent助手养成计划

文章围绕将ChatBI打造成个人Agent助手展开,从用户视角拆解使用流程,分析提问、反问澄清、结果验证等环节的困难与解决办法,还提及MCP协议、通义千问3及阿里云百炼服务对Agent开发的助力。

阿里云开发者
算法论文7

「Next-Token」范式改变!刚刚,强化学习预训练来了

微软新研究提出「强化预训练(RPT)」新范式,将下一个 token 预测任务重新定义为推理任务,利用海量文本数据进行通用强化学习。该方法有扩展、低风险等优点,实验显示其提升了语言建模能力。

机器之心
算法论文8

One RL to See Them All?一个强化学习统一视觉-语言任务!

国内初创公司 MiniMax 提出 V-Triune 系统,让 VLM 单一训练流程学视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中能提升显著,凸显统一 RL 方法有效扩展

机器之心
算法论文8

RL特训出「押题大师」?破解模型微调中的多样危机与灾难遗忘

近年来,基于验证奖励的强化学习(RLVR)成为提升大语言模型推理能力的重要路径,但许多经RL微调的模型出现‘越训越单一’问题。复旦大学等团队聚焦长期被忽视的KL散度项,提出DPH - RL方法,缓解多样坍塌。

新智元
推荐文章7

“Skill 不就是长一点的提示词吗?”

文章回应了对'skill是长提示词'的质疑,指出差异在于提示词配套的是ChatBot还是Agent。ChatBot只能对话,Agent能调用工具干活。Skill渐进加载,具复用、组合、迭代等优势,是提示词工程化封装。

宝玉AI
算法论文8

LeCun在Meta的最后一篇论文

LeCun于11月11日提交最新论文《LeJEPA:无需启发式的证明且扩展的自监督学习》,当天其离职Meta消息曝光。论文提出LeJEPA自监督学习方法,解决表示崩溃问题,还回顾了JEPA架构发展,虽毁誉参半,但LeCun将继续推进世界模型工作。

量子位
推荐文章7

理解Ray Data分布式数据处理原理-源码分析

Ray Data是构建于Ray之上的分布式数据处理库,提供高能且扩展的API,用于AI场景。文章从源码入手,分析其流式执行原理,包括读取数据源、构建数据处理、输出数据等环节,还介绍了LogicalPlan转PhysicalPlan及流式执行过程。

阿里云开发者
9

合理利用应用商店ASO优化工具,提升APP产品权重和转化率(工具篇)

应用商店优化(ASO)是提升App曝光和下载转化率的关键过程,涉及榜单排名、关键词搜索、转化率及其他展位优化。图标、截图、宣传文本、关键词设置等都是影响用户感知和下载决策的重要因素。

孔学长
推荐文章7

吴恩达来信:利用编程智能体实现更高效开发

吴恩达认为编程智能体正加速各类软件工作,按加速程度排序为前端开发、后端开发、基础设施、研究。前端开发加速明显,后端开发有提升但幅度小,基础设施和研究方面加速有限。

DeeplearningAI
新闻资讯8

没有生物学背景,靠ChatGPT和AlphaFold,他为爱犬定制了全球首支个化癌症疫苗

澳大利亚程序员Conyngham的爱犬患癌,他无生物学背景,靠ChatGPT和AlphaFold分析数据,经多番尝试,让教授定制全球首支为狗设计的mRNA个化癌症疫苗,部分肿瘤缩小一半。

AI寒武纪