「搜索智能体模型」共找到 9620 篇相关文章
拒绝计算“一视同仁”!Elastic Attention:让大模型学会“看人下菜碟”
现代大语言模型用全注意力机制计算复杂度高,现有混合注意力策略是静态的。为此提出Elastic Attention,引入轻量级Attention Router,具备动态路由等亮点,在主流模型测试中效果好。
迈向长程智能体,人大高瓴发布149页全景综述
新问题出现,长程智能体研究应运而生。人大高瓴发布149页综述,梳理超900项研究,从多视角给出长程智能体统一定义、分类与路线图,分析难点,提出核心论点与发展路径等。
Skill开发黄金法则!谷歌放出5种智能体Skill设计模式
谷歌工程师研究Skill开发生态,浓缩出5条黄金法则与5种设计模式,包括工具封装器、生成器等,每种模式附可运行ADK代码,还能组合使用,助开发者构建更智能的Agent。
多模态推理新范式:上海AI Lab新作证明“画”出答案比“说”出答案更靠谱
上海人工智能实验室等联合提出DiffThinker模型,利用扩散模型构建全新视觉推理范式。它在视觉中心任务上表现优异,准确率碾压GPT - 5等模型,还能与MLLM协同推理实现1 + 1 > 2的效果。
世界模型一口气输出小时级视频不跑偏,开源了
Alaya Lab等联合推出的Alaya - EVOKE能生成小时级视频,解决常见问题。它把记忆搬到模型外,改造教师模型,经多轮技术操作,实验成绩佳,给出清晰训练方案,也指出项目边界。
大模型评估排障指南 | 关于 LaTeX 公式解析
这是大模型评估排障指南系列第二篇,聚焦 LaTeX 公式解析。评估难点是解析和比较模型输出与标准答案,无标准方法。lm - evaluation 框架用 sympy 解析准确率约 0.94,还给出缓解问题办法。
李飞飞3D世界模型公测,网友已经玩疯了
今日李飞飞创立的World Lab推出全新3D世界生成模型Marble并开启公测。普通人能靠文本等生成专属3D世界,还能在VR体验。它功能强大,未来将重点发力交互性。
模型越聪明越“不听话”?MathIF基准揭示AI服从性漏洞
上海人工智能实验室与香港中文大学研究团队发布论文,用MathIF基准揭示大模型“聪明”和“听话”有矛盾,越擅长推理越易忽略指令,还分析了原因并给出让模型更“听话”的方法。
Anthropic 那个“强到不敢发”的模型,终于来了!
今天凌晨,Anthropic 发布新模型 Claude Mythos Preview,它曾被指‘强到不敢发’。该模型能力跃升,尤其网络攻防能力突出,但因具‘双重用途’仅向少数伙伴开放,用于防御性网络安全项目。
腾讯云TencentOS智能运维平台TManager正式发布 | Q推荐
为满足企业运维需求,腾讯云推出 TencentOS Server 首款智能运维管理平台 TManager。它有 30 余项功能,能 AI 智能诊断,内部稳定运行多年,覆盖复杂场景,还赢得标杆客户信任,提升运维智能化水平。