「模型能力提升」共找到 9837 篇相关文章
太反差了!那边Claude强制「刷脸」认证,这边国内Coding Plan被外国人疯抢
Anthropic要求Claude用户进行严格身份验证,被网友吐槽。而国产GLM Coding Plan因模型能力提升在海外走红,海外版涨价后,海外开发者研究买中国版,国内购买也很火爆,闲鱼还出现代抢生意。
刚刚,谷歌Gemini 3.8登场!姚顺宇:RSI巨大飞跃
深夜谷歌推出Gemini 3.8,六周内第三款Flash系列模型。含通用的Gemini 3.8 Flash和网络安全专用的Gemini 3.8 Flash Cyber,提升推理、代码能力,在多场景表现出色。已面向不同群体开放。
ACL 2026 | 腾讯混元Agents工具学习新范式
腾讯混元团队在 ACL 2026 Findings 发布的 ToolCPT 指出,Agent 用不好工具病根在预训练。它从真实代码挖工具,写说明书,融入预训练,实验显示能有效提升工具运用能力,但也有局限和成本。
GPT-5:我更强了,就这?“看不见”的升级
OpenAI 发布 GPT - 5,它未带来 AGI 相关的震撼升级,而是更注重实用。其训练有新特点,具备推理强、编程能力提升等特性,是 AI 从‘模型炫技’到‘产品体验打磨’转变的标志。
DeepSeek新版R1直追OpenAI o3!实测来了:“小版本升级”着实不小
DeepSeek在端午节前更新R1新版本DeepSeek - R1 - 0528,看似小版本更新实则提升巨大,在LiveCodeBench上几乎与OpenAI o3 - high相当,实测显示编程等能力显著优化,直追闭源模型。
中美 NeoLab 对话:模型和 Agent 如何实现「持续学习」?
在新加坡 AGI Playground 2026 舞台上,AMI Labs 林敏和 Mind Lab Andrew Chen 深度对谈,探讨 Agent 如何将经验转化为能力、持续学习。两人对持续学习给出不同答案,还讨论记忆、学习等基础问题及解决办法。
全球排名前三,复旦自进化Harness Engineering让GPT‑5.4再涨7个点
2026 年以来,Harness Engineering 成业界热词。复旦大学等团队提出 Agentic Harness Engineering (AHE),可实现 Harness 自动优化。实验中,AHE 让 GPT - 5.4 分数提升,适配 GPT - 5.5 后排名全球第三,且有良好泛化能力。
与三位前沿研究者聊AI Agent:规则、环境与热潮下的真问题|五源小酒馆Vol.31
五源小酒馆对话三位AI Agent前沿研究者,探讨其发展进展、挑战。他们分享对Agent定义、能力边界判断等,提及过去技术突破,如DeepSeek工作,也指出通用Agent瓶颈,探讨未来模型能否提有价值问题等。
PolarDB AI助手:自然语言驱动的智能数据库运维新范式
企业数据库运维复杂度高,专业人才稀缺成瓶颈。阿里云PolarDB推出AI助手,基于大语言模型与专家知识库,有智能问答等核心能力,以自然语言交互降低使用门槛,提升运维效率与系统稳定性。
与Gemini Diffusion共振!首个扩散式「发散思维链」来了
西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型推理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强后的模型在相关任务上超越现有模型。