「模型使用经验」共找到 8935 篇相关文章
谷歌DeepMind团队新框架:让AI告别每次从头开始,在任务流中越用越聪明
谷歌DeepMind团队联合伊利诺伊大学提出Evo-Memory框架和ReMem架构,改变大模型只能被动检索历史的现状,让智能体实现终身学习。通过基准测试验证其有效性,实验显示ReMem优势明显,还揭示记忆复用关键因素。
“技术迭代速度是唯一护城河!”李彦宏把百度 AI 秀了个遍,还称芯片拿大部分钱的 AI 生态不健康
李彦宏在百度世界大会指出,AI产业结构正从‘正金字塔’向‘倒金字塔’转变,健康生态中应用应创造最大价值。百度展示多项成果,如数字人、AI搜索等,还发布文心大模型5.0和百度伐谋。
5小时通关《原神》主线!Lumine:AI玩家正式登场
Lumine能像人类一样理解游戏画面、推理并操作,以接近人类效率5小时通关《原神》蒙德主线,还能零训练玩《鸣潮》等。它是开放式研发方案,靠少量数据和显卡让模型成强大智能体。
从扫街榜到Robotaxi,空间智能彻底打开了高德的想象空间
这周一,一张神秘海报引发对高德的猜测。11月5日,高德宣布与小鹏合作提供Robotaxi服务。其空间智能形成闭环,比语言模型更接近AGI,还能为Robotaxi提供安全保证,且在多领域有落地应用。
DeepAgent:能够自主找工具的深度思考智能体,工具&任务随心配
现有智能体框架自主性差、工具使用受限。中国人民大学等机构研究者提出DeepAgent,能自主思考、发现工具并执行动作。它在多基准测试中表现出色,为构建更强真实世界智能体迈进重要一步。
夸克 AI 对话助手的邪修打开方式:一句话直通网盘,看电影、找资料全拿下
阿里“C计划”首个成果,夸克App深度整合对话助手,用Qwen3 - Max模型。可随意切换模式,其独特之处是提问资料或电影,能直返夸克网盘链接,“搜、用、存”一气呵成,与其他AI助手不同。
适用所有团队研发提效|带你1分钟上手基于Claude Code的AI代码评审实践
文章介绍用Claude Code和AONE MCP Server实现智能AI代码评审。分析当前CR流程痛点,阐述解决方案架构、配置及效果,提效超50%,还给出使用方式、建议与后续优化方向,为团队AI提效提供参考。
OpenAI 发布GDPval,可真实评估现实世界经济价值。Claude Opus 4.1 拿下第一
OpenAI推出GDPval,可评估AI在真实经济价值任务上的表现。它从9个行业选44种职业,设1320个真实任务。Claude Opus 4.1表现最佳,前沿模型速度快、成本低。OpenAI计划扩展GDPval,还开源部分内容。
突破后训练瓶颈?Meta超级智能实验室又一力作:CaT解决RL监督难题
AI后训练依赖监督微调或程序化检查器,但很多有价值任务缺这两种资源。Meta超级智能实验室等机构研究者提出CaT方法,把推理时额外计算当教师信号,为大模型提供监督,实验显示效果显著。
拒绝招聘、产品粗糙,却成史上最快增长软件公司!4个00后“整顿”创业圈:大家都不信,才是我们的机会
Cursor是AI编程工具崛起代表,3个月发布、16个月超36万用户。其背后是4个00后创立的Anysphere公司。创始人Michael Truell分享创业经验,包括早期项目、转型细节,以及Cursor挑战GitHub Copilot的历程。