「关键token」共找到 1633 篇相关文章
GPT-5.2来了…
OpenAI推出GPT - 5.2系列,是适合专业知识工作的模型。它在专业工作表现、编程能力、可靠性与安全性等多方面有提升,定价公布,已向付费用户逐步推出,此次更新重在夯实基础。
上下文工程的精髓在于删除?
Hugging Face工程师Philipp Schmid整理分享,Manus团队重写五次代理系统,发现删代码比加功能好。AI模型存在‘上下文腐败’问题,Manus给出清理上下文、避免共享大脑、精简工具等解决办法。
AI 行业最新的 18 个前沿认知
文章整理了火山引擎AI领航者计划活动中,大厂、投资人和创业者对AI行业的18条前沿认知,涵盖模型层、应用层和产业层,如强化学习成竞争焦点、视频生成将崛起等,展现2026年行业新趋势。
最新推荐系统论文PDF列表-及「深度学习推荐系统2.0」所有参考文献
这是「王喆的机器学习笔记」资源帖,应读者建议更新推荐系统论文repo。收录在推荐系统发展史上有重要作用及业界最新进展的论文,还列出具体目录,方便扩展阅读。
性价比搏击:Grok 4 Fast 推理成本直降 98%
xAI上周五发布旗舰模型轻量化版Grok 4 Fast,推理成本直降98%。它通过强化学习在基准测试表现佳,有原生工具调用能力,采用统一架构,性价比高,或改写大模型竞争规则。
Anthropic的多智能体,真的有必要吗?
作者曾质疑多智能体系统,看了Anthropic对「Claude Research」的说明后有了改观。介绍了多智能体系统定义、性能提升、代价,还阐述构建方法、评估方式,公开三个核心提示词及协作模式。
AI真有希望考清北了!豆包1.6多模态推理发威,闯关数理化带图大题
火山引擎原动力大会发布豆包大模型1.6,它是国内首款多模态SOTA模型,支持256k上下文长度。实测中它解答高考数理化带图大题表现出色,还具备图像识别、视频理解、GUI操作等能力。此外,火山引擎还推出系列工具和平台助力企业。
从打分器到思考者:RM-R1用推理重塑模型价值判断
伊利诺伊大学香槟分校团队提出 RM - R1 框架,将奖励建模定义为推理任务。它引入推理奖励模型和链式评估准则机制,经两阶段训练,在多基准测试中表现超大规模模型,验证了推理能力对奖励模型的重要性。
巧妙!一个传统技术让国产视觉基础模型直接上大分
格灵深瞳的Glint - MVT视觉基础模型表现出色,线性探测准确率高于CLIP等,下游任务效果佳。其引入间隔Softmax损失函数,结合虚拟类别构造等优化方案提升性能,团队专注视觉研发,务实开放。
AI办公工具实测红榜|打工人到底该留哪一款?
2026年AI办公赛道竞争焦点转向‘抢入口’,产品繁多让打工人选择困难。文章实测热门产品,分全能型、专项型、专业研究三类,横评各产品优势短板,还深度体验库库AI。