「大模型应用开发」共找到 9786 篇相关文章
说句话,造个3D世界!腾讯VibeWorlding氛围造世界
香港科技大学(广州)和腾讯团队开源VibeWorlding框架,实现说句话造3D世界。它由VWE - Bench和VibeWorlding - Gym组成,开源模型经强化学习训练后成绩逆袭,证明强化学习解锁3D推理潜力巨大。
出价算法新SOTA——快手首提生成式强化学习出价
文章介绍快手新提出的生成式强化学习出价模型GAVE,回顾出价算法发展历程。GAVE结合生成式与强化学习优势,有Score-based RTG等创新,经竞赛、实验验证效果佳,为出价技术带来新方向。
CuteDSL-1: Introduction
文章介绍CuteDSL,它因Cutlass编译慢、调试难等痛点而生,可在Python构建DSL,编译快、调试易且性能无损。文中阐述其架构、使用方法、与PyTorch集成优势等,还提及基于CuTe的开发及性能对比。
上海AI Lab、浙大EagleLab等提出RRVF:利用「验证非对称性」,只输入图片学习视觉推理
上海AI Lab、浙大EagleLab等联合完成研究,提出RRVF框架,利用「验证非对称性」,仅输入图片学习视觉推理。它构建闭环系统,通过迭代推理、视觉反馈等步骤训练模型,实验显示效果佳,证明验证法则力量。
国产AI首次「长出」原生记忆,非Transformer架构成新王!机器狗当场引爆WAIC
WAIC世界人工智能大会上,国产黑马RockAI的大模型Yan 2.0 Preview亮相,可多终端无损部署。它基于非Transformer架构,训练效率高,有原生记忆,实现端侧AI,展现出自主学习和多模态能力,引发关注。
烧钱换能力,老员工经验作废!一线Agent厂商、用户经验亲述:抛弃技术驱动,巨额投入如何不打水漂?
集成 AI Agent 竞赛打响,2024 年中国 AI Agent 软件市场规模破 50 亿。InfoQ 对话来也科技汪冠春和英科医疗陈坤,从不同角度谈产品理念与应用策略,涉及引入时间、定位、推广、架构调整等多方面内容。
PDF难点解析:处理复杂表格、水印、印章、复选框、信息抽取等7项任务,6大能力
文章介绍Nanonets - OCR - s可处理关键信息提取、视觉问答等7项任务,具备LaTeX方程识别、图像描述等6项能力,还给出体验链接。但测试发现英文体验优于中文,模型有重复输出、幻觉严重问题。
一句话搞定后端?揭秘被 52.1k 开发者选择的 PocketBase:真能让你 0 运维快速上线产品吗?
PocketBase是“把后端打包成一个文件”的开源项目,既可以作为独立的轻量后端服务直接运行,也能作为Go库嵌入到应用中。它能解决团队做MVP等遇到的痛点,有诸多核心功能和技术优势。
内存直降50%,token需求少56%!用视觉方式处理长文本
在NeurIPS 2025论文中,南京理工大学等校研究团队提出VIST框架,为大语言模型长文本高效推理提供视觉解决方案。它模仿人类阅读机制,让模型具备选择性阅读能力,减少Token需求和内存使用。
从 Prompt 到 Context:基于 1400+ 论文的 Context Engineering 系统综述
本文围绕Context Engineering展开,介绍其定义、与Prompt Engineering区别,从LLM OS视角说明其重要性,指出context处理不当的问题,对其分类及处理管理过程进行探讨,还提及面向LLM Context开发的变化。