「AI编码模型」共找到 13748 篇相关文章
实测 MiniMax H3:开源“斩杀线”蔓延到视频模型圈
本文实测 MiniMax H3 视频模型,它 8 月 3 日开源,成本低至 0.5 元/秒,在编辑榜成绩佳。它定位全模态生成,能多素材输入。实测效果好,价格约为 Seedance 2.5 的三分之一,还支持原生剪辑,适配多芯片与工具。
半量工具,双倍效能:ARPO革新大模型强化学习
大语言模型在多轮工具调用场景有挑战,传统强化学习算法有探索效率低和资源消耗大问题。本文提出ARPO,通过量化token熵分布变化设计自适应探索机制,降低工具调用成本且提升多轮推理性能。
《动手写AI Agent》权限与安全:让 Agent 不敢乱来
文章指出LLM不理解操作后果,不加权限的AI Agent如定时炸弹。介绍权限模型设计,采用Deny→Ask→Allow三层过滤;给出权限规则结构,用glob模式匹配工具参数;还解释用glob而非正则的原因。
万字解码 Agentic AI 时代的记忆系统演进之路
文章深入探讨 Agentic AI 时代记忆系统,介绍记忆对智能体的重要性、人脑与智能体记忆的定义分类及操作,还分析 Memory Bank、LETTA 等多款产品实现,总结技术演进趋势,最后提及 Tablestore 的优势。
OpenAI内部代码泄露!最强模型「皇帝」登基,0思考延时吓人
OpenAI代码泄露,神秘的「企鹅家族」模型在测试,代号Emperor的推理预算最高。同时,ChatGPT将推「记忆搜索」功能。此前谷歌Gemini 3抢份额,OpenAI或提速发布GPT - 5.2抗压。
AI Agent平台Sedai获2000万美元融资,主打云优化
AI Agent平台Sedai获2000万美元B轮融资,由AVP领投。它聚焦云优化,用智能体取代人工运维,节省成本。产品应用广泛,核心能力突出,2024年收入增长7倍,计划扩平台、引新功能、扩市场团队。
无需外部数据!AI自问自答实现推理能力进化
卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的自我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计自监督奖励函数。实验显示其能提升Qwen2.5 - 3B - Instruct多任务准确率。
LeCun世界模型:48倍规划速度,单卡就能跑
Yann LeCun团队推出LeWorldModel世界模型,仅靠两条数学规则,让机器几小时学会物理运转逻辑,动作规划速度超同类48倍。它跳出复杂训练修补怪圈,单卡训练,在多环境测试表现出色,还展现对物理法则的深刻理解。
龙虾爆出漏洞,斯坦福 OpenJarvis 重新定义本地 AI Agent,附实测
OpenClaw开源项目虽火但漏洞多,安全堪忧。斯坦福发布本地优先的个人AI Agent框架OpenJarvis,其架构模块化,数据本地处理更安全,安装简单,还能让Claude Code部署,值得关注。
Google新研究:降低大模型幻觉的全新视角——充分上下文!
谷歌新研究《SUFFICIENT CONTEXT: A NEW LENS ON RETRIEVAL AUGMENTED GENERATION SYSTEMS》提出“充分上下文”概念,剖析RAG系统失败原因并给出解决方案,对提升企业AI准确性和可靠性有重要意义。