长文理解」共找到 805 篇相关文章

算法论文8

Anthropic:上下文工程在AI Agents的正确打开方式!

在‘提示工程’后,‘上下文工程’成焦点。它是提示工程延伸,因信息过多模型会‘失焦’,上下文是稀缺资源。文章介绍高效上下文‘剖学’、运行时检索策略、周期任务应对方法等。

PaperAgent
新闻资讯7

对话微软研究员华文越:横跨数学、哲学与计算机,她如何重构 Agent 的信任基石?

本期访谈邀微软研究员华文越跳出技术视角,探讨如何用跨学科思维决Agent落地难题,如找模型等间最优、建信任标准,还将深入其工作逻辑及对Agent未来思考。4月18日直播。

深度学习自然语言处理
算法论文7

大模型也需要睡觉!让AI打个盹,醒来更聪明

卡内基梅隆大学和马里兰大学研究发现,大模型处理上下文易累傻。受人脑机制启发,设计睡眠机制,让模型在上下文窗口快满时打盹,反复咀嚼信息,压缩进期权重。测试显示,增加“睡眠”轮次能提升深度推理表现。

量子位
产品应用8

MiniMax M3 实测:第一流的模型,已经对执行层动手了

文章对 MiniMax M3 模型进行多维度实测。它强化 Coding 与 Agent 能力,能完成任务,与 Sonnet 4.6 竞技各有优势,多模态能力强,价格有竞争力,MiniMax Code 意在争夺开发者工作流入口。

AI科技评论
推荐文章8

Agent下半场!比Prompt更重要的是「上下文工程」,Anthropic首次系统阐述

Anthropic发文章阐述上下文工程,指出构建语言模型重点正从提示工程转向上下文工程,探讨了其与提示工程区别、重要性,给出实践指导原则、新趋势及应对时程任务策略。

AI寒武纪
推荐文章7

大语言模型高考数学拿高分靠强化学习,那文科考高分得靠什么?

大语言模型在高考数学拿高分靠强化学习,但文科题无标准答案,此方法行不通。豆包1.6系列高考文科全科获683分,靠训练数据、思维链、上下文和多模态直接读图等因素。

宝玉AI
开源动态7

AI 剪辑杀器 CutClaw 开源了!再也不用手动卡点了!

CutClaw是面向视频与音乐的端到端自动剪辑系统,可自动析素材,按文字指令生成踩点短片,部署简单,有短期和期目标,也给出运行慢的原因与优化建议。

GitHubStore
新闻资讯7

3年手搓ChatGPT!剑桥天才少年在Minecraft游戏中爆火回归

MC大神sammyuri时隔3年发布新作,在MC中复刻ChatGPT,名为CraftGPT。虽参数量小,但用Transformer架构,能和用户交互。模型训练用Python和小数据集,视频存档公布助理原理。

新智元
新闻资讯8

范式跃迁:LLM + EC重构算法设计范式,华为&港城大夺冠CVRP国际顶级赛事

近日,华为与港城大联合团队‘OptVerse - CityU’在CVRPLib BKS全球挑战赛夺冠。他们用‘大模型(LLM)+进化计算(EC)’架构,刷新98个历史最优,51个设新纪录,验证AI在算法设计潜能。

机器之心
产品应用8

字节豆包2.0重磅发布!成本暴降一个数量级,Seed团队揭秘视频Agent竞争关键

今天,字节正式发布豆包大模型 2.0 系列,围绕大规模生产环境需求优化,提供多款通用 Agent 与 Code 模型。其成本优势明显,多模态能力升级,未来将聚焦链路智能系统构建。

AI前线