长context」共找到 698 篇相关文章

推荐文章7

大语言模型高考数学拿高分靠强化学习,那文科考高分得靠什么?

大语言模型在高考数学拿高分靠强化学习,但文科题无标准答案,此方法行不通。豆包1.6系列高考文科全科获683分,靠训练数据、思维链、上下文和多模态直接读图等因素。

宝玉AI
开源动态7

AI 剪辑杀器 CutClaw 开源了!再也不用手动卡点了!

CutClaw是面向视频与音乐的端到端自动剪辑系统,可自动解析素材,按文字指令生成踩点短片,部署简单,有短期和期目标,也给出运行慢的原因与优化建议。

GitHubStore
推荐文章7

Anthropic:怎么才能控制模型的行为,做好Agents?

Anthropic发关于AI Agents博客,围绕如何配置上下文让模型输出期望行为展开。指出上下文是有限资源,有Context Rot现象,介绍了上下文工程概念、构成,还提及即时策略、时间任务处理方法及实践建议。

探索AGI
产品应用8

字节豆包2.0重磅发布!成本暴降一个数量级,Seed团队揭秘视频Agent竞争关键

今天,字节正式发布豆包大模型 2.0 系列,围绕大规模生产环境需求优化,提供多款通用 Agent 与 Code 模型。其成本优势明显,多模态能力升级,未来将聚焦链路智能系统构建。

AI前线
推荐文章7

Anthropic说:Session Management 是最好用的 Harness Engineering!

Anthropic指出管理Session、Context等在Claude Code上已落地。模型上下文并非越越好,rewind比纠错好,compact要把握时机,subagent可隔离上下文,如今行业看重agent产品runtime。

探索AGI
算法论文8

从答题到做实验:SciAgentGym让大模型进入科学工作流

复旦大学NLP实验室提出SciAgentGym,为科学智能体搭建工作流环境,还设计了评测集SciAgentBench。实验显示模型接入工具能提升成功率,但流程任务性能下降。论文还提出SciForge构建训练数据,提升了模型表现。

机器之心
新闻资讯7

靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩?

近日,云平台 Vercel 遭入侵,攻击者通过被入侵的第三方 AI 工具 Context.ai 实施攻击。Vercel 确认‘安全事件’,称少量客户受影响,谷歌 Mandiant 团队协助调查。此事发生在其 IPO 前夕,或引发连锁安全暴露。

AI前线
产品应用8

Claude Opus 4.7 发布!留给人类的时间,不多了

Anthropic 发布 Claude Opus 4.7,核心升级是让 AI 跑且复杂任务,还能自我验证结果。它视觉能力超强,编程能力提升,新增 /ultrareview 功能,API 多了调节档,不过 token 数量或增加,成本可能上浮。

AGI Hunt
算法论文7

The Batch: 881 | 一千万 token 的输入上下文

Google的Ali Behrouz等人设计“记忆模块”集成到类transformer架构ATLAS,能处理一千万token输入。它替代注意力层,训练后在上下文任务中表现佳,但小模型,大规模表现未知。

DeeplearningAI
新闻资讯8

机器人界的「Imagenet 时刻」,李飞飞团队官宣全球顶级具身智能挑战赛

李飞飞团队与斯坦福AI实验室官宣首届BEHAVIOR挑战赛将登陆NeurIPS 2025。这是具身智能“超级benchmark”,涵盖1000个日常任务,以50个时段任务为核心赛题,还是全面的具身智能研究资源。

机器之心