图文对」共找到 2213 篇相关文章

算法论文8

DPO与GRPO谁更胜一筹?港中文、北大等联合发布首个系统性比研究

港中文、北大等团队首次全面比DPO和GRPO算法在自回归图像生成中的应用,评估其在域内、域外性能,探究奖励模型及扩展策略的影响,为开发高效RL算法提供新思路。

机器之心
算法论文7

ICML'25 | 告别手动SFT!一句话得到你的专属大模型LoRA

传统微调方法开销大、部署难,Text-to-LoRA (T2L) 框架应运而生。它基于自然语言指令 Transformer 模型即时适配,有三种架构变体,采用两种训练方法,实验显示其在多维度表现有效。

PaperAgent
新闻资讯7

三大云厂同时瘫了?Cursor、ChatGPT跟着倒下!网友:整个互联网都要废了

北京时间昨天晚上,AWS、谷歌云、Azure和Cloudflare同一时间发生中断,谷歌云服务全球瘫痪3小时,导致旗下及第三方多服务受影响。Spotify、Cloudflare也受波及,引发宕机原因及云厂商依赖的讨论。

AI前线
新闻资讯8

Transformer八周年!Attention Is All You Need被引破18万封神

Transformer已满8岁,其开创性论文《Attention Is All You Need》被引超18万次,掀起生成式AI革命。它催生诸多前沿产品,让人类跨入生成式AI时代,虽起初未受关注,但如今影响深远,谷歌态度也在改变。

新智元
新闻资讯7

The Batch:833 | 针智能体的钓鱼攻击

研究人员发现误导基于大语言模型的自主智能体的方法,即通过在热门网站植入恶意链接,利用智能体热门网站的‘隐性信任’攻击。测试显示智能体易受诱导执行有害行为。

DeeplearningAI
算法论文8

AGI真方向?谷歌证明:智能体在自研世界模型,世界模型is all You Need

谷歌DeepMind研究人员表明,通用AI智能体处理复杂长期任务需学习内部世界模型,还证明可从智能体策略提取该模型。此研究成果补充多领域,AI发展和安全意义重大。

机器之心
新闻资讯8

Andrej Karpathy 分享ChatGPT模型选择指南

前OpenAI创始成员Andrej Karpathy发文分享ChatGPT模型使用指南,点出关键事实,如o3适合重要任务。社区热烈讨论,专业用户分享策略,还o4 - mini等模型表现给出反馈。

AGI Hunt
推荐文章7

快速理解热门LLM大语言模型

本文用通俗易懂方式帮读者理解LLM、Transformer、Prompt等基本概念,介绍大模型API使用,如温度参数、角色设定等,还提及Function Calling、Agent、MCP等内容,并AI未来发展作出假想。

腾讯技术工程
算法论文7

正确答案 ≠ 正确推理,CoT 或成大模型推理能力停滞的「罪魁祸首」?

研究指出当前大模型推理能力评估多关注答案准确性,忽视推理步骤。通过前沿模型测试发现,2023 - 2024 年大模型推理能力提升停滞,进步靠提示工程,自底向上策略最有效。

AI科技评论
产品应用7

大模型系统提示词逆向(2)—— Cursor

作者研究大模型提示词注入时,用简单提示词“骗”出 Cursor 系统提示词。文中分析提示词生效原理、 Cursor 有效的原因,还提及提示词泄露的安全问题及开发者应建议。

AI Reading Hub