智能大屏」共找到 7378 篇相关文章

7

国产模型高考出分了:裸分683,选清华还是北

字节跳动Seed团队公布全球第一梯队模型“高考成绩”,Gemini理科655分排第一,豆包文科683分排第一、理科648分排第二。文章解析评测标准,分析各科目表现,还介绍豆包能力提升技术亮点。

量子位
算法论文7

正确答案 ≠ 正确推理,CoT 或成模型推理能力停滞的「罪魁祸首」?

研究指出当前模型推理能力评估多关注答案准确性,忽视推理步骤。通过对前沿模型测试发现,2023 - 2024 年模型推理能力提升停滞,进步靠提示工程,自底向上策略最有效。

AI科技评论
新闻资讯7

推理能力比拼,《推理模型综合测评报告 2025 》正式发布

过去半年,推理能力成模型新分水岭。InfoQ研究中心评测八款热门模型,围绕五维度,用超90%原创试题。发现各模型在不同维度表现有差异,推理模型发展正从‘一个脑’变为‘带工具的多能智能体’。

InfoQ
开源动态8

6.5k星!轻量级多智能体对话编排框架Agent Squad

Agent Squad是轻量级多智能体对话编排框架,有6.5k星。它能管理多AI代理、处理复杂对话,具智能意图分类等特性。新SupervisorAgent可协调多专业代理,还有演示应用及多种使用示例。

GitHubStore
产品应用7

基于OpenAPI和AI coding的上云智能体构建实践

文章介绍基于OpenAPI和AI coding构建上云智能体的实践。分析不同编程范式,结合AI coding发展与Multi - Agent问题,阐述构建方案,包括业务场景、构建方法、技术实现、当前效果及后续展望,还提及文档智能与RAG构建LLM知识库。

阿里云开发者
开源动态8

AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒

当行业争论30B能否挑战万亿参数时,清华、人、面壁智能与OpenBMB联合研发的AgentCPM-Explore开源,基于4B参数在深度探索任务表现出色,还开源配套平台,解决小模型性能提升难题。

深度学习自然语言处理
算法论文8

句子级溯源+生成式归因,C²-Cite重塑模型可信度

在人工智能发展背景下,模型内容可信度成焦点。北邮百家AI与小米团队提出溯源模型C² - Cite,首创上下文感知归因生成技术,解决现有归因模型缺陷,已被WSDM 2026收录。

机器之心
算法论文8

你的AI Agent越用越蠢?港中、浙戳破「记忆」的谎言

香港中文学联合浙江学发布论文指出,当前主流的Agent记忆方案只是「备忘录」,而非真正的记忆。论文归纳出三结构性缺陷,提出双系统共存架构,引发学术界广泛讨论。

新智元
8

跳出超级 App 之争,鸿蒙系统级智能如何改写 AI 赛道规则?

2025年AI热潮转向落地场景深耕,华为鸿蒙在终端操作系统层面开辟新赛道。其通过鸿蒙智能体框架打破‘APP孤岛’,走‘C+B’差异化路线,还推出开放平台等繁荣生态,推动终端智能化迈进。

AI科技大本营
推荐文章8

万字长文!模型(LLM)推理优化技术总结(非常详细)

文章聚焦模型推理优化技术,介绍推理过程分预填充与解码阶段,还阐述模型并行、注意力机制优化、模型优化及服务技术等,如多查询注意力减少内存,FlashAttention 优化计算顺序。

AINLPer