长上下文大语言模型」共找到 8160 篇相关文章

推荐文章7

上下文就是一切!行业热议话题:提示工程是否应该改名

AI圈热议提示工程是否应改名“上下文工程”。Shopify CEO等发表看法,指出其在LLM应用和AI Agent构建中很重要,还分析了重要性、优化方法,给出实践经验,强调要在性能、成本和准确性间平衡。

歸藏的AI工具箱
新闻资讯8

智谱创始人唐杰透露:原生多模态模型将在数月内上线

智谱创始人唐杰透露原生多模态模型数月内上线。智谱上市后股价涨幅大,但多模态是短板。唐杰还判断今年AI最可能在长时程任务突破,阐述技术支柱、自我进化等观点,称将重塑各行业。

AI前线
推荐文章7

超越 Prompt 和 RAG,「上下文工程」成了 Agent 核心胜负手

本文称「上下文工程」成 Agent 核心胜负手,它指在正确时间为 Agent 提供正确信息,超越 Prompt 和 RAG。文章归纳五大策略,如转移、压缩等,并结合 *The Bitter Lesson* 启示,探讨构建面向未来的 AI Agent。

海外独角兽
算法论文8

推理路径的动态调控:让大模型学会“恰到好处”的思考

当前大模型推理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入推理过程,在多个STEM基准测试中缩减推理步骤、提升准确率。

深度学习自然语言处理
开源动态8

刚刚,智谱开源了他们的最强多模态模型,GLM-4.5v。

智谱接连开源GLM - 4.5和GLM - 4.5V,后者为多模态模型,总参数106B,在42个评测基准中41个达到SOTA。经测试,它视觉推理强、速度快,还有视频理解等功能,API定价良心,体现持续开放精神。

数字生命卡兹克
算法论文8

ICML 2025 | CoTo:让LoRA训练「渐入佳境」,模型融合、剪枝样样精通

来自多机构研究者提出CoTo渐进式训练策略,解决LoRA训练难题。该策略在训练早期随机失活部分适配器,后期提高激活概率,提升模型融合、剪枝能力,还能增强单任务性能与训练效率,已被ICML 2025接收。

机器之心
开源动态8

字节跳动开源超强USO模型,AI绘图六边形战士来了

在AI图像生成领域,风格和主题驱动的图像生成一直脱节。字节跳动智能创作实验室推出USO模型,构建海量数据集,设计两阶段训练法,引入风格奖励学习范式,化解此难题,且已全面开源。

AIGC开放社区
开源动态7

Hugging Face 发布 FineTranslations:一个万亿级的多语言平行文本数据集

Hugging Face 发布 FineTranslations,这是含超 1 万亿 Token 的多语言数据集,用于提升机器翻译质量。它源于 FineWeb2,用 Gemma3 27B 翻译创建,数据生成流程可复现公开,还能用在其他任务。

InfoQ
新闻资讯8

20万人抢的全球大模型第一股,我中签了

智谱在港交所上市成全球大模型第一股,作者申购中签。智谱专注AI Coding,迭代快,GLM - 4.7成绩亮眼,商业化数据佳,还有诸多有意思细节,虽行业竞争大,但它表现不错。

花叔
新闻资讯8

Manus数十亿美元卖身Meta,智谱夺得全球大模型第一股

2025年末中国AI领域有两大喜事,通用AI Agent公司Manus被Meta数十亿美元收购,其发展迅速成果显著;智谱启动招股,即将成为全球大模型第一股,虽研发投入高,但营收增长快,获资本青睐。

AIGC开放社区