渐进式结构推理」共找到 2521 篇相关文章

产品应用8

Claude 4破解困扰人类4年系统bug,30年码龄程序员200小时没搞定,GPT-4.1/Gemini-2.5也做不到

30年码龄程序员4年没搞定的顽固型‘白鲸bug’,Claude Opus 4配合Code模式,用30个prompt+1次重启,几小时就破解。此前GPT - 4.1等模型都失败,凸显Claude编程与推理能力强。

量子位
新闻资讯8

Veo 3全网实测惊艳所有人!DeepMind CTO:规模是AGI全部吗?

谷歌推出视频生成模型Veo 3,一句提示词就能打造电影质感短片,还能音画同步,引发网友惊叹。DeepMind CTO在访谈中表示,规模非AGI唯一要素,还提及Deep Think模式及Veo 3进展等。

新智元
推荐文章8

北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。

Founder Park
产品应用8

实测腾讯Hunyuan-Image2.0,首个毫秒级实时图像生成模型

今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒级实时生成,还在画面质量等方面升级,新增实时绘画板功能。

带你学AI
算法论文8

启发学习:让大模型认知从外化到内生

当下大模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。

机器之心
新闻资讯7

Grok Bot代码也泄露了?

8月23日X上有人称Cursor团队发布的Grok Bot 0.18.0,runtime source map是开着的,此人重构其客户端代码并放于GitHub,一天浏览量约88万。该重构项目有诸多实用实验和功能。

GitHubStore
开源动态7

任何错误只犯一次:TencentDB Agent Memory 的团队记忆实践

文章聚焦 TencentDB Agent Memory 的团队记忆实践,从组织协作现状出发,阐述其原理、结构、构建方法,通过多方面测试验证其价值,提炼出设计原则,指出其核心是治理系统,目标是提升协作带宽。

腾讯技术工程
算法论文8

紫东太初推出GMC核心集剪枝方法,少80%Token仍满血保真多模态能力

视觉Token冗余是多模态模型高效推理与落地的瓶颈,传统筛选方法有缺陷。紫东太初团队提出GMC核心集剪枝方法,具双阶段架构,优势多,实验显示其能在减少Token同时保持性能。

量子位
新闻资讯8

Claude Code把自己的提示词删掉80%,我照着砍了自己的60%

Anthropic将Claude Code系统提示词删减超80%,编码评测表现无明显下降。文章阐述删减背后判断,给出六条变化策略、四类文件写法及两条方法论,还介绍实施步骤,作者按此精简提示词约60%。

花叔
算法论文8

竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500

大语言模型在竞赛编程场景易失败。南大、清华等研究者提出Solvita框架,由四个角色形成闭环,构建可训练图结构知识网络积累经验。实验显示其在多评测中表现强,提升不靠增加token。

新智元