模型架构」共找到 8584 篇相关文章

开源动态8

节前重磅:开源旗舰模型新SOTA,智谱GLM-4.6问世

国庆前智谱AI发布新一代旗舰模型GLM-4.6并将开源,它在多方面提升,如编码、上下文长度等,评测性能佳,token消耗降低。经实测,其代码、研究、开发等能力强,成全球开源AI领域重要力量。

机器之心
算法论文8

模型才是 Agent 的未来?这篇立场文把话挑明了

AI Agent浪潮来袭,主流用LLM构建,但英伟达和佐治亚理工学院研究人员论文指出,多数Agent场景中,小语言模型(SLM)已足够强、更好管、更省钱,还给出迁移清单、避坑建议和参考系统形态。

AI寒武纪
算法论文7

Mini-Omni-Reasoner:实时推理,定义下一代端到端对话模型

现有端到端对话模型推理能力未解锁,因深度思考带来延迟。为此提出 Mini - Omni - Reasoner,采用边思考边表达范式,突破‘要么快,要么准’困境,还设计了数据合成管线和五阶段训练方法,实验证明其性能提升明显。

机器之心
新闻资讯8

GPT‑5深夜发布:模型之战结束,Agent之战开始!

昨晚,炒作一月的GPT - 5正式发布,标志原生Agent时代到来。体验显示其压低幻觉、提升指令遵循与推理能力。文中还对比了GPT - 5、Gemini、Claude等模型在不同场景表现,指出御三家路线分化及三条反常识判断。

探索AGI
新闻资讯7

当AI开始过度思考「hey」这个字…

两张对话截图展现语言模型缺陷,用户发简单问候,模型过度分析,从问候语正式程度到表情符号语义权重,这种过度分析让对话不自然,错过人类交流重点。

AI工程化
开源动态8

HexStrike代理:让大模型继承专家经验,显著提升渗透测试效率

HexStrike是开源渗透测试工具,以MCP为底座。其核心智能组件IntelligentDecisionEngine是专家系统,将安全专家经验规则化,通过知识库和算法提供工具选择和参数优化,提升渗透测试效率。

AI与安全
开源动态7

DeepSeek 把 Harness 开源了:模型、工具、Agent Loop 全是插件

8月13日,DeepSeek面向全球开发者开放DeepSeek Harness开发者预览版v0.1并开源代码。其特色是一切皆插件,提供四种运行模式,内置多Agent系统,有创新但编排范式未突破,还采用仅追加的会话日志。

InfoQ
算法论文8

比思维链准43%!逻辑脑+大模型直觉,推理可靠性大幅提升

中德研究团队发布成果,给大模型外挂「逻辑脑」,结合答案集编程与LLM,构建神经 - 符号框架,提升空间推理准确率,让AI能说清逻辑、跨任务迁移,迈向更可靠的通用推理。

新智元
产品应用8

超越OpenAI、拿下全球双料第一,“AI吴彦祖”背后大模型SOTA了!

国产大模型MiniMax发布Speech - 02,拿下两项全球权威语音基准测评第一,是榜单前十唯一国产玩家。它超拟人、个性化、多样,技术创新,且在多行业落地,全模态布局领先。

量子位
产品应用8

MiniMax M3 实测:第一流的模型,已经对执行层动手了

文章对 MiniMax M3 模型进行多维度实测。它强化 Coding 与 Agent 能力,能完成长任务,与 Sonnet 4.6 竞技各有优势,多模态能力强,价格有竞争力,MiniMax Code 意在争夺开发者工作流入口。

AI科技评论