意识可及」共找到 5888 篇相关文章

产品应用8

一款产品,同时为人类和 Agent 设计,LibTV 是怎么做的?

3月18日,LiblibAI旗下AI视频创作平台LibTV上线,它从设计之初就兼顾人类创作者和Agent。创作者端工作流画布控;Agent端通过Skill接口创作,交付编辑项目。该产品还针对两者差异做了设计,价格也便宜。

Founder Park
7

以史为鉴:从互联网泡沫到英伟达五万亿

文章回顾互联网发展历程泡沫破灭影响,对比当下AI浪潮,指出英伟达成首家市值破五万亿美元公司。探讨AI是否为泡沫,认为其未来发展或类似互联网,还分析英伟达走势国产GPU替代、AI边缘推理领域前景。

芯师爷
算法论文7

逆强化学习全新视角的大模型对齐技术

文章从逆强化学习(IRL)视角回顾LLM对齐进展。先介绍强化学习基础挑战,将LLM生成过程化为MDP,探讨无奖励函数的MDP,说明需神经奖励模型,还阐述通过奖励建模实现IRL多种优化方法。

PaperAgent
推荐文章7

【博客转载】CUDA Cooperative Groups

文章介绍CUDA cooperative groups,它让开发者创建和管理能同步通信的线程组,为GPU并行算法编程提供更灵活高效方式。文中讨论并行归约算法用cooperative groups的实现,还对比不同归约求和方法性能。

GiantPandaLLM
算法论文7

「Next-Token」范式改变!刚刚,强化学习预训练来了

微软新研究提出「强化预训练(RPT)」新范式,将下一个 token 预测任务重新定义为推理任务,利用海量文本数据进行通用强化学习。该方法有扩展性、低风险等优点,实验显示其提升了语言建模能力。

机器之心
产品应用7

再见Bug!谷歌超级编码智能体Jules上线,免费使用直连GitHub

谷歌推出编程智能体Jules,进入全球测试阶段,有Google账户的开发者免费试用每日5次。它基于Gemini 2.5 Pro模型,能写代码、修Bug等,还连GitHub简化流程,预计今年晚些时候推更多功能和企业版。

新智元
开源动态7

本文关注vllm V1中管控模型分布式推理的Executor部分,介绍其类型、Executor-Workers架构数据传输机制,对比V0架构优势,以单机多卡的MultiprocExecutor为例展开讲解,还提不同数据量的传输方式相关代码。

猛猿
推荐文章8

Agent开始“自我进化”:会出题、会反思,还会自己长出新技能

文章围绕自进化Agent展开,介绍其概念、受重视原因三大技术路线,涵盖各路线代表工作的特点、评估对比,指出研究空白如总结者训练等,最后还介绍了基于Agentic AI的全链路数据助手Dola。

腾讯技术工程
算法论文8

One RL to See Them All?一个强化学习统一视觉-语言任务!

国内初创公司 MiniMax 提出 V-Triune 系统,让 VLM 单一训练流程学视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中性能提升显著,凸显统一 RL 方法有效性和扩展性。

机器之心
产品应用8

LLM 技术在有道词典笔上的应用实践

本文围绕LLM技术在有道词典笔的应用展开。先分析端侧大模型落地挑战,如算力、功耗等。介绍有道词典笔等硬件应用,对比端侧与云侧AI优劣。还阐述模型落地模式、算法优化“子曰3数学模型”开源情况。

InfoQ