良率提升」共找到 2935 篇相关文章

新闻资讯8

收手吧GPT-5-Codex,外面全是AI编程智能体!

OpenAI推出专为智能体编程设计的GPT-5-Codex,其在代码重构、审查和缺陷发现上表现提升,具动态资源分配机制。文中还提及Codex起源、Harness概念及OpenAI内部工具,当前编程智能体竞争激烈。

新智元
算法论文8

ICML 2025 | CoTo:让LoRA训练「渐入佳境」,模型融合、剪枝样样精通

来自多机构研究者提出CoTo渐进式训练策略,解决LoRA训练难题。该策略在训练早期随机失活部分适配器,后期提高激活概率,提升模型融合、剪枝能力,还能增强单任务性能与训练效率,已被ICML 2025接收。

机器之心
开源动态8

如何实现可验证的Agentic Workflow?MermaidFlow开启安全、稳健的智能体流程新范式

随着大语言模型发展,多智能体系统成新前沿,「Agentic Workflow」受关注。但现有系统存在合理性难保证等问题。新加坡和南洋理工团队推出MermaidFlow,以Mermaid语言显式建模工作流,提升可解释性与可控性,实验性能优秀。

机器之心
新闻资讯7

GPT-5被意外泄露,奥特曼宣布即将发布!

一则GPT - 5被意外泄露的消息引发关注,SecureBio的github配置文件中出现相关内容,暗示要把‘推理’提升到新高度。OpenAI CEO等暗示GPT - 5即将发布,但不打算短期内推出有IMO金牌级别数学能力的正式产品。

PaperAgent
8

一天 15k 星,代码生成碾压 Claude,连 Cursor 都慌了?谷歌 Gemini CLI 杀疯了

谷歌发布 Gemini CLI,是其 AI 助手终端版,有慷慨免费使用配额。它开源且功能多,支持多平台。接入 Gemini 2.5 Pro 通用模型,开发者反馈其代码生成和修复能力强,谷歌在代码能力上提升明显。

InfoQ
算法论文7

DeepSeek们越来越聪明,却也越来越不听话了。

论文《When Thinking Fails: The Pitfalls of Reasoning for Instruction - Following in LLMs》用实验验证,模型推理能力变强时,提示词遵循能力变差。研究团队对15个模型测试,发现用CoT推理后执行准确率下降,还提出4种提升指令遵循效果的方案。

数字生命卡兹克
新闻资讯8

UCSD谢澎涛创业:用AI搞科研,4小时交付顶刊水平成果,已获数百万美金融资

谢澎涛团队推出面向AI for Science的AIBuildAI Science Agent,在NatureBench评测中排名第一,超多数通用编程智能体。该智能体可独立完成模型研发,效率大幅提升,还探讨了其能力边界、应用及对行业的影响。

DeepTech深科技
开源动态8

阶跃开源JetSpec,大模型推测解码提速近10倍

随着Agent应用爆发,大模型推理效率成AI行业焦点。阶跃星辰联合多校团队开源JetSpec,该框架面向推测解码,在H100上把MATH - 500解码速度提升到9.64倍,突破了推测解码的扩展天花板。

AIGC开放社区
推荐文章7

团队授权:分散化的架构决策

文章以黏菌创建网络为隐喻,探讨软件团队去中心化架构决策。介绍转型历程,包括重组团队、建立建议流程、创建上下文图等,阐述各环节作用、挑战与收益,强调其能提升决策质量与团队参与度。

InfoQ
开源动态8

比NanoBanana更擅长中文和细节控制!兔展&北大Uniworld V2刷新SOTA

兔展智能与北京大学的UniWorld团队推出图像编辑模型UniWorld - V2,它提出UniWorld - R1框架,在权威测试中超越顶尖闭源模型。该框架通用性强,能提升其他基础模型性能,相关论文、代码和模型已开源。

量子位