「开发框架」共找到 3036 篇相关文章
首发限时免费两周!实测腾讯混元Hy3:Agent能力飞升,日常主力毫无压力
腾讯混元Hy3正式版发布,尺寸300B,在多领域表现亮眼,追平甚至超越大参数模型。作者用三个刁钻场景实测,Hy3在全栈开发、3D游戏开发、办公任务中表现出色,幻觉率低,达生产级标准。
AI能帮忙厨房看火了!面壁智能开源全模态模型MiniCPM-o4.5,边看边听还能主动抢答
面壁智能开源全模态模型MiniCPM-o4.5,能边看边听还主动抢答。它引入全双工多模态实时流机制,在多方向达全模态模型领先水平。该模型是端侧原生,将与开发板配套,助力端侧智能硬件开发。
交互扩展时代来临:创智复旦字节重磅发布AgentGym-RL,昇腾加持,开创智能体训练新范式
强化学习之父指出人工智能迈入「经验时代」,在此背景下,复旦、创智、字节研究者发布 AgentGym - RL 框架。它是全新端到端 RL 框架,提出 ScalingInter - RL 方法,7B 模型经训练追平顶尖商业模型,为 AI 发展注入动力。
大模型推理也能“智能调度”:让奖励模型按需分配算力的动态路由机制 | ACL 2026
生成式奖励模型(GRM)推理策略存在算力浪费问题。腾讯混元与新南威尔士大学联合提出 E - GRM 框架,将模型不确定性定义为调度信号,按需推理。文章从多维度解读该框架,并展示实验评估结果。
小红书发布 SWE-Bench Mobile:当 AI Agent 面对亿级用户 App 代码库,最高通过率仅12%?
小红书联合多科研机构发布 SWE-Bench Mobile,它是首个还原‘端到端’开发流程的基准,以小红书 App 实际任务为核心。评测显示,AI Agent 在移动端开发能力上限低,架构设计比模型本身重要,简单提示策略效果更好。
从零开始,教你用Codex搓出属于你自己的第一个硬件。
作者分享用Codex开发久坐提醒猫爪硬件的过程。先与Codex聊需求、写代码,再按其提供的清单买硬件,连线、烧录也靠它指导,还可让它调试动作、操控3D打印,体现AI时代硬件开发的便捷。
为大模型思考装上“猎鹰重装引擎” :腾讯混元 SEAT 重塑深度思考
本文深度解析腾讯混元最新发布的 SEAT 自适应并行扩展推理框架。它让大模型 CoT 升级,应对复杂推理任务。该框架通过多轮并行推理和语义熵导航,解决大模型深度思考的局限,且适配多种大模型,性价比高。
如何让AI帮你做前端自动化测试?我们这样落地了
本文介绍阿里基于AI的UI自动化测试框架在专有云质量保障的实践。框架用开源browser - use等工具,采用自然语言驱动用例、动态元素定位等机制,还应对了大模型幻觉等挑战,也提及构建企业级数据分析Agent方案。
退隐3年后回归,周末写的AI一夜刷屏、一周拿下10万Star增速超Linux,Clawdbot之父首次长谈:如今几乎不看自己发布的代码
本文是对OpenClaw开发者Peter Steinberger的深度专访。他曾打造PSPDFKit,隐退三年后回归,用大模型工具开发出OpenClaw。他分享了开发历程、工作方式,探讨AI对编程的影响,还指出大公司采用AI的难点及对开发者的建议。
腾讯混元AI Infra核心技术重磅开源:推理吞吐提升30%!
腾讯混元AI Infra团队开源生产级高性能LLM推理核心算子库HPC-Ops,基于生产环境痛点开发,降低底层算子开发门槛,实现显著性能突破。在真实场景下,混元、DeepSeek模型推理QPM提升,单算子性能也超越主流算子库。