代码基座模型」共找到 8765 篇相关文章

开源动态8

全新合成框架SOTA:强化学习当引擎,任务合成当燃料,蚂蚁港大联合出品

蚂蚁通用人工智能中心自然语言组联合香港大学自然语言组推出PromptCoT 2.0,押注任务合成。它让30B - A3B模型在数学代码推理任务达SOTA,全面升级效果、数据和方法,还将考虑多方向发展。

量子位
新闻资讯8

吴恩达:产品经理才是 AI 时代的最大瓶颈

吴恩达指出,AI编程助手使写代码变快,‘决定做什么’成新瓶颈,即‘产品管理瓶颈’,产品经理比程序员更稀缺。他强调用户同理心和心智模型,认为软件开发正从技术驱动转向价值驱动。

AGI Hunt
新闻资讯8

红杉专访 OpenAI Codex 团队:AI Coding 的未来,应该是异步自主 Agent

红杉专访 OpenAI Codex 团队,探讨 AI Coding 未来。OpenAI 5 月推出的 Codex Agent 可并行处理多任务、独立完成编程全流程。从代码补全到任务委托,AI 编程朝解放生产力方向发展,团队分享了产品思考等内容。

Founder Park
算法论文7

苹果出手!改进GRPO,让dLLM也能高效强化学习

苹果研究团队针对扩散语言模型(dLLM)在编码任务中表现不明的问题,基于7B级代码生成MDM DiffuCoder展开研究,定制优化GRPO提出coupled - GRPO算法,填补开源dLLM训练和推理机制空白。

机器之心
新闻资讯8

这些关于研发提效的深度实践,值得每一位开发者关注 | AICon

6月27 - 28日AICon北京站上,一线大厂技术大牛将分享“AI赋能研发提效”经验,涉及AI编程范式革新、代码智能化落地、研发流程优化等多方面,呈现技术演进与落地路径。

InfoQ
产品应用8

Qwen3.7:智能体新前沿

阿里云正式发布面向智能体时代的Qwen3.7-Max模型,将通过API提供服务。它能力全面,编程、办公、长周期执行等表现出色,适配多框架,在多场景评测中领先,能驱动生产力跃升,还经多实战测试验证实力。

千问大模型
算法论文8

横扫八大数学竞赛:清华微软联合提出STAR-PólyaMath,Apex基准超GPT-5.5 13.5%

清华大学与微软亚洲研究院团队提出推理多智能体系统 STAR - PólyaMath,构建探索 - 推理 - 验证框架,解决大模型长程数学推理瓶颈,在八大数学竞赛基准获最优成绩,还可泛化到其他推理场景。

机器之心
产品应用8

Claude Code 首席工程师揭秘 AI 如何重塑开发日常!

近日,Anthropic发布Claude Code首席工程师Boris与对外沟通负责人Alex的对话,揭秘Claude Code诞生、能力、技巧与展望。它可在终端辅助编程,适配多环境,还集成Claude Max套餐,新模型让其功能更强大。

AI科技大本营
算法论文8

多轮Agent蒸馏终于不翻车!港中文x通义新方法成功率暴涨18点,训练还快32%

香港中文大学联合阿里通义事业群提出TCOD训练方法,解决多轮Agent蒸馏稳定性难题。它只需对现有OPD代码做极少改动,提升了模型成功率,压缩行动步数,还减少训练时间,未来或成训练长程Agent标配。

量子位
新闻资讯7

马斯克“开大”,600亿重金收购Cursor

SpaceX 宣布将以 600 亿美元收购代码生成初创公司 Cursor,或支付 100 亿美元合作。此前 xAI 编程项目落后,3 月挖角 Cursor 核心人员。Cursor 受竞争压力且缺算力,合作有望提升模型智能水平。交易或影响 SpaceX IPO 估值。

InfoQ