「深度生成模型」共找到 9183 篇相关文章
RL缩放王炸!DeepSWE开源AI Agent登顶榜首,训练方法、权重大公开
今天凌晨,Together.ai联合Agentica开源AI Agent框架DeepSWE,基于Qwen3 - 32B模型用强化学习训练。所有内容开源,测试中性能超所有开源Agent框架,证明强化学习训练潜力。
AI 赋能 eBay 支付风控:从用户行为到交易安全的全面智能化|AICon 北京
6月27 - 28日AICon全球人工智能开发与应用大会北京站将举办,eBay高级技术专家魏瑶将分享《AI赋能eBay支付风控》。eBay用AI提升风控能力,也面临挑战并提出方案,大会还有多专题论坛。
项目在GitHub上已获得约3600+star,探秘 ChatDoctor:LLaMA 微调后的 AI 医生,真能在线问诊?
现代医疗资源不均、问诊效率低,ChatDoctor应运而生。它基于LLaMA微调,有医学对话微调等亮点,技术优势多,适用于在线问诊等场景,与同类对比优势明显,开源助力医疗对话模型发展。
Nature警告:AI「数据饥渴症」引爆学术宕机潮!90%知识库濒临崩盘
Nature揭露AI爬虫疯狂「啃食」学术网站数据,致服务器瘫痪。DiscoverLife、BMJ等受影响,运营方难防「坏爬虫」,急需国际协议规范AI数据使用。
张鹏对谈李广密:Agent 的真问题与真机会,究竟藏在哪里?
本文是《今夜科技谈》直播沉淀,极客公园整理。拾象科技李广密、钟凯祺从多维度拆解 Agent 真问题与机会,探讨产品、技术路径、商业模式等,指出 Agent 发展方向与挑战。
苹果AI 路线图曝光:从未打算开发聊天机器人
苹果软件工程高级副总裁Craig Federighi在WWDC 2025表明,苹果从未打算开发聊天机器人,而是要将智能深度整合到所有平台体验中,实现环境智能,此言论引发网友热议。
CVPR2025 | 多模态LLM评测Tutorial
多模态大语言模型(MLLMs)研究热门,有效评估成关注焦点。CVPR2025将举办多模态LLM评测Tutorial,梳理评估基准,探讨评估方法,聚焦‘幻觉现象’,团队经验丰富,覆盖多板块内容。
AI加持的开源知识库新秀:PandaWiki,如何用它打造智能化文档系统?
PandaWiki 是长亭科技开发的 AI 大模型驱动的开源知识库搭建系统,能助力用户快速构建智能化文档系统。它有 AI 创作、问答、搜索等功能,安装简单,适用于多场景,优势明显。
吴恩达对谈LangChain创始人:企业构建Agen系统的核心认知!
吴恩达与LangChain联合创始人Harrison Chase深度对话,点明构建Agent系统关键要点,如关注系统‘Agentic’、解决构建核心挑战、模块化构建等,还提及被低估领域、MCP问题及AI创业制胜之道。
Mamba核心作者新作:取代DeepSeek在用的注意力机制,专为推理打造
Mamba核心作者Tri Dao团队提出GTA和GLA两种专为推理定制的注意力机制,在减少KV缓存用量、保持模型质量的同时,显著提升解码速度,优化长上下文推理能力。