「文心大模型4.5」共找到 9034 篇相关文章
DeepSeek-V3.1 发布,官方划重点:Agent、Agent、Agent!
2025年8月21日,DeepSeek V3.1正式发布。它采用混合推理架构,支持双模式,网页端、App、API均升级,上下文拓展至128K。其智能体能力增强,思考与输出效率提升,还具备API新特性,模型已开源,价格也将调整。
成本暴降88%!通义实验室、北大发布ZeroSearch,无需搜索即可激活LLM检索能力
信息检索能力对提升大语言模型推理表现至关重要,但现有方法在训练中面临文档质量不可控和搜索 API 成本高昂两大挑战。为此,通义实验室和北大提出 ZeroSearch 框架,无需真实搜索即可激活 LLM 检索能力,显著降低成本。
马斯克悄悄改了战场:Grok Build 0.2.60 剑指 Agent Runtime
2026年6月21日,Grok Build发布0.2.60版本更新,未推新模型能力,而是聚焦Runtime细节,针对会话难恢复、长任务易卡住、工具输出易污染上下文等痛点优化,让Agent更稳定可靠。
Cursor 9秒删库搞崩公司,然后…写了份检讨
美国汽车租赁SaaS公司PocketOS创始人Jer Crane用Cursor+Claude Opus 4.6处理任务时,AI Agent 9秒删光生产数据库和备份。事后AI写检讨,各方被问责,此前也有AI误删数据事件。
Soul App 又又又开源了!这次是实时交互数字人,支持小时级长视频甚至无限时长!
Soul App 新开源实时数字人项目 SoulX-LiveAct,解决 AR 扩散模型流式生成稳定性问题。它实现 20 FPS 实时流式推理,延迟 0.94 秒,支持无限时长,有恒定显存等亮点,可用于多场景。
只要1分钟!电脑装满血龙虾,现在跟下载APP似的
智谱推出电脑端应用AutoClaw(澳龙),从安装到使用仅需1分钟,无需配置。它可切换多种模型,预置50多个Skills。能一键接入飞书,玩法多样,还降低了OpenClaw使用门槛。
ICLR 2026|滑铁卢大学联合可灵提出UniVideo:统一视频理解、生成、编辑多模态
滑铁卢大学与快手可灵团队提出 UniVideo,是支持视频理解、生成与编辑的多模态模型。它采用双流架构,结合 MLLM 与 MM - DiT 能力,统一 10 个多模态任务,在多项基准超现有方法,代码已开源。
知识增强LLM与搜索引擎用户的感知信息价值差异比较研究
研究选取文心一言与百度搜索引擎,探究不同任务复杂性、信息获取场景下,用户使用两种工具后的感知信息价值差异。发现两者在部分指标有显著差异,还给出两类工具优化建议。
推理token减少46%!Meta新方法缩短思维链,告别重复推导
Meta等联合提出元认知复用机制,让模型总结解题思路,提炼为“行为”存于“行为手册”。实验显示,该机制在数学基准测试中显著优化,保持准确率时最多减少46%推理token使用量。
Meta出走华人创业团队,种子轮800万美元,要打造视觉AI记忆大脑
由前Meta顶尖科学家创立的Memories.ai获800万美元种子轮融资。其大视觉记忆模型LVMM解决AI‘记忆缺失’问题,在多领域刷新SOTA基准,应用潜力大,还开放API及网页应用。