「长上下文问题」共找到 4079 篇相关文章
大型语言模型稳定强化学习的新路径:几何平均策略优化GMPO
本文介绍了大型语言模型稳定强化学习新路径——几何平均策略优化GMPO。它是GRPO稳定化版本,通过优化几何平均替代算术平均,解决GRPO训练不稳定问题,在多任务实验中显著优于GRPO。
马斯克Grok 4正式发布:世界最大AI超级计算机就训练了这?
Grok 4公开基准测试有进步,但在高级推理测试表现差,视觉理解仍是短板。性能提升多靠整合符号工具,无重大技术创新,‘幻觉’问题没实质进展,xAI官方对道德对齐信心不足。
Claude Code 强大的秘密究竟是什么?
Claude Code 强大源于其强大模型基础、丰富实用的内置工具、不压缩上下文信息及无 IDE 包袱等优势。相比之下,OpenAI 的 Codex 因模型能力、强化训练不足等落后,Anthropic 还靠亏本推广积累数据。
专访微软CTO:微软大力发展Agent,智能体将无处不在
微软CTO Kevin Scott在“Build2025”大会期间接受专访,解读微软推动智能体生态发展。微软重视智能体应用,众多组织用其平台开发。他还探讨编程看法、行业变化、安全模型、市场模式等问题。
Gemini新手教学
最近Google推出教育优惠,可免费使用15个月含Gemini Advanced等在内的AI产品。作者分享使用Gemini经验,指出其在上下文长度和生态打通方面优于ChatGPT,老牌厂商家底足,OpenAI下半场有压力。
蚂蚁武威:下一代「推理」模型范式大猜想
文章围绕下一代「推理」模型范式展开,蚂蚁技术研究院武威提出不同观点,认为长思维链推理未必最优,未来推理模型或更低维稳定,还探讨推理定义、重要性及解法猜想,如结合快慢思考等。
写2000字提示词,不如先一键生成3D白模!AI视频创作进入“预演时代”
随着AI模型能力增强,科班人士利用其专业能力在AI视频创作赛道优势明显。updream预演台将影视行业预演工作流引入创作画布,解决了AI视频生成中‘拍什么’和‘怎么拍’的问题,虽有局限但意义重大。
谷歌Veo 3玩法大升级!“360°”关键词解锁3D效果,Fast版同分辨率价格暴降5倍
谷歌旗舰视频模型Veo 3玩法再升级,添加“360°”提示词可解锁3D环绕效果。其Fast版速度更快、价格更便宜,同分辨率下价格暴降5倍,虽面部细节和光照表现有下降,但解决了部分问题。
开源 AI 视频平台
开源 AI 视频平台集成剪辑生成器、AI 短视频、YouTube 工作室三大工具,能将长视频转短视频,为业务生成营销视频,还具备免费 YouTube 工具包。支持多平台发布,自托管永久免费。
DeepSeek陈德里开发自动研究Skill,写一篇论文人类只动脑2小时
DeepSeek研究员陈德里用自己开发的技能DeliAutoResearch等完成研究综述论文。论文提出自动研究智能体L1–L5自主度分类体系,对比四大架构模式,分析17个主流系统,还提出六大开放问题。