长安的荔枝」共找到 989 篇相关文章

推荐文章8

Agent下半场!比Prompt更重要的是「上下文工程」,Anthropic首次系统阐述

Anthropic发文章阐述上下文工程,指出构建语言模型重点正从提示工程转向上下文工程,探讨了其与提示工程区别、重要性,给出实践指导原则、新趋势及应对时程任务策略。

AI寒武纪
推荐文章7

大语言模型高考数学拿高分靠强化学习,那文科考高分得靠什么?

大语言模型在高考数学拿高分靠强化学习,但文科题无标准答案,此方法行不通。豆包1.6系列高考文科全科获683分,靠训练数据、思维链、上下文和多模态直接读图等因素。

宝玉AI
推荐文章7

翁荔最新博客:我们可能高估了模型,却严重低估了那层“脚手架”

前OpenAI全研究副总裁翁荔在新博客聚焦AI领域Harness Engineering。她认为Harness是决定模型在现实任务中走多稳、多远的‘脚手架’,并梳理其演进路线,也指出研究面临评估、全等瓶颈。

DeepTech深科技
开源动态7

AI 剪辑杀器 CutClaw 开源了!再也不用手动卡点了!

CutClaw是面向视频与音乐的端到端自动剪辑系统,可自动解析素材,按文字指令生成踩点短片,部署简单,有短期和期目标,也给出运行慢的原因与优化建议。

GitHubStore
产品应用8

字节豆包2.0重磅发布!成本暴降一个数量级,Seed团队揭秘视频Agent竞争关键

今天,字节正式发布豆包大模型 2.0 系列,围绕大规模生产环境需求优化,提供多款通用 Agent 与 Code 模型。其成本优势明显,多模态能力升级,未来将聚焦链路智能系统构建。

AI前线
产品应用8

腾讯出手,第一个小龙虾全管家它来了。

腾讯推出首个专为OpenClaw打造的小龙虾全管家,集成于腾讯电脑管家。该管家功能全面,涵盖Skills全检测、文件保护等,解决了AI全痛点,是适合普通人的全方案。

数字生命卡兹克
算法论文8

从答题到做实验:SciAgentGym让大模型进入科学工作流

复旦大学NLP实验室提出SciAgentGym,为科学智能体搭建工作流环境,还设计了评测集SciAgentBench。实验显示模型接入工具能提升成功率,但流程任务性能下降。论文还提出SciForge构建训练数据,提升了模型表现。

机器之心
新闻资讯8

QCon 2026 北京站收官:以 AI 之力,重塑软件工程新生态

4月16 - 18日,QCon全球软件开发大会·北京站(2026)举办,超2000人参与。极客邦赵钰莹点明企业AI落地要点;黄东旭等专家分享见解,探讨软件变革、全等;还有25个专题及展区展示,后续接力6月上海AICon。

InfoQ
产品应用8

Claude Opus 4.7 发布!留给人类的时间,不多了

Anthropic 发布 Claude Opus 4.7,核心升级是让 AI 跑且复杂任务,还能自我验证结果。它视觉能力超强,编程能力提升,新增 /ultrareview 功能,API 多了调节档,不过 token 数量或增加,成本可能上浮。

AGI Hunt
算法论文7

The Batch: 881 | 一千万 token 的输入上下文

Google的Ali Behrouz等人设计“记忆模块”集成到类transformer架构ATLAS,能处理一千万token输入。它替代注意力层,训练后在上下文任务中表现佳,但小模型,大规模表现未知。

DeeplearningAI