「LLM应用平台」共找到 4087 篇相关文章
谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍
大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。
AI Agent 十问十答,降低认知摩擦
文章以问答形式梳理技术术语与价值信息,介绍AI Agent定义、与传统软件区别、演进原因等,还阐述组件、原理、提升输出效果方法,探讨Workflow与LLM关系及单/多智能体系统相关内容。
这个开源项目把视频处理与投稿接成一条流水线
Y2A-Auto是面向YouTube、AcFun和bilibili的自动化处理工具,将下载、识别、翻译等操作集成到Web管理后台。用户可手动或自动处理,支持多平台投稿,有多种功能和灵活配置,适合持续处理授权内容的用户。
这一次,谷歌Veo 3.1教Sora做视频!角色0变形,4K竖屏直接满分
谷歌Veo 3.1迎来重磅升级,优化移动端体验,上传素材图片就能创作有趣视频。亮点包括素材生视频一致性强、支持原生竖屏输出、有业界领先的1080p和4K超分辨率,现已可在多平台体验。
QQ音乐你变了,竟能免费在AI PC上原创一首《大东北》
QQ音乐在AI PC上可免费AI作歌,只需输入灵感,几分钟就能创作出原创歌曲。AI PC改变应用生态,降低创作门槛,更安全自由。背后是英特尔酷睿Ultra处理器革新架构,还发起加速计划。
RL成本降幅超90%!Meta提出Agent训练新范式DreamGym
传统强化学习(RL)训练LLM Agent面临成本高、任务多样性不足等挑战。Meta团队提出DreamGym框架,以经验合成为核心,通过三大组件协同工作,在多种任务和模型上提升性能,为通用Agent训练开辟新路径。
首次实现第一视角视频与人体动作同步生成!新框架攻克视角-动作对齐两大技术壁垒
新加坡国立大学等联合发布EgoTwin,首次实现第一视角视频与人体动作联合生成,攻克视角 - 动作对齐与因果耦合瓶颈。它基于扩散模型,通过三大创新设计解决核心难题,实验性能超基线,为多领域应用提供落地基座。
国产AI击败Meta:ReasonRank荣登BRIGHT榜单第一
基于LLM的段落排序方法中,listwise排序虽有优势,但当前重排器难处理复杂推理查询。ReasonRank通过生成推理密集型训练数据及两阶段后训练,赋予listwise重排序器强推理能力,在BRIGHT榜单击败Meta。
首个为手机而生的通用Agent?!苹果做不到的事,“野路子”智谱抢先实现了
苹果预计2026年升级Siri实现自主行动,但完整落地的执行型Agent仍未推出。8月20日,智谱发布AutoGLM 2.0,宣称是全球首个可在手机用的Agent,开创‘Agent + 云手机 / 云电脑’范式,能代理操作高频应用。
大模型之后,AI 开始“自己动手”了
从生成式AI到Agentic AI,互联网从“信息获取”转向“任务完成”。全球科技巨头抢滩智能体,国内腾讯云升级智能体开发平台。腾讯吴运声表示,技术与业务需求双轮驱动其发展,还分享了应对落地挑战的办法。