「编程任务」共找到 2870 篇相关文章
告别大模型“失忆”!人大开源MemSifter:轻量代理先思考再回忆,搞定长时记忆
中国人民大学团队提出全新LLM记忆管理框架MemSifter,打破长时记忆管理‘精度不够’和‘成本太高’的困局。它将记忆检索‘外包’给轻量级代理模型,采用任务结果导向的RL训练范式,在8个基准测试中超越现有SOTA方案。
突然,被GLM-4.7的Coding交付能力惊到了
国内大模型圈因智谱启动A股上市而兴奋时,GLM系列再展“卷王”姿态,本月开源旗舰GLM - 4.7。它从代码大模型变为任务交付引擎,实测在多场景表现出色,能理解复杂意图、交付高质量代码。
黄仁勋放话:英伟达全员拥抱智能体!
黄仁勋称英伟达全员将配AI助手,未来AI智能体成主流。Meta小扎、微软纳德拉等也认为AI重塑开发者角色。当下AI编程工具掀起革命,虽有局限,但已改变开发周期,企业多已应用。
OpenAI 黑科技 Deep Research 诞生记:一个工程师的“不务正业”如何改变 AI 战争格局
OpenAI宣布美国用户可免费使用集成于ChatGPT的AI研究助手Deep Research。OpenAI负责人分享其背后故事,探讨起源、人类专家数据作用等,还提及RFT时机、代理安全性等,并展望其能访问私有数据,适用于具体任务。
GPT之父把AI扔回1930年:没见过一行代码,却「发明」了Python!
GPT之父Alec Radford带队发布总参数130亿的大模型「talkie」,其训练数据冻结在1930年,没学过编程却能写Python代码,证明LLM可用旧知识推理。团队后续还有升级计划。
狂揽 11.8K Star!用大厂 PUA 话术「驯化」AI,这个项目把 Claude 逼成了卷王!
GitHub上名为PUA的项目狂揽11.8K Star,作者用大厂PUA话术‘驯化’AI,总结了AI的‘五大摆烂行为’,建立‘心理学框架’,实测数据显示能提升AI编程效率,还介绍了安装方式和常用命令。
解决智能体手工构造难题! 浙大&腾讯提出 ReCreate,从零自动构建领域智能体
浙大、腾讯等机构研究者提出ReCreate框架,不依赖手工设计,让智能体自主构建。它从交互经验中找优化方向,有三重设计,实验显示能提升多领域任务通过率、降成本,未来或开启AI“自我制造”时代。
八年后,Meta教会了Transformer「显式思考」
10月20日Meta上线新论文《The Free Transformer》,作者François重写Transformer思维方式,造出Free Transformer新架构。它在解码器内加入随机潜在变量,让模型生成内容前先‘思考’,实验显示在多任务上性能显著提升。
又一推理新范式:将LLM自身视作「改进操作符」,突破长思维链极限
Meta等机构研究者将LLM视为「思维」改进操作符,探究并行 - 蒸馏 - 精炼(PDR)推理方法。实验显示,PDR在数学任务中提升准确率,还训练8B模型让推理方法更适配,减少训练与部署的不匹配。
OpenAI惊人自曝:GPT-5真「降智」了!但重现「神之一手」,剑指代码王座
GPT-5发布后引发热议,其IQ测试成绩不佳遭吐槽,但实际是「路由」问题。解锁神级GPT-5关键在prompt,医学家借它重现「神之一手」。它编程能力强,挑战Anthropic,还推动AI向「智能体式推理」发展。