「模型参数量」共找到 8281 篇相关文章

算法论文8

Relink:为GraphRAG动态构建证据图

大语言模型在开放域问答中有‘幻觉’问题,GraphRAG结合LLM与知识图谱缓解此问题,但现有方法有缺陷。作者提出‘推理并构建’新范式和Relink框架,实验显示其性能领先,对RAG系统设计有启示。

PaperAgent
开源动态8

8B 端侧写作智能体 AgentCPM-Report 开源,DeepResearch 终于本地化

1月20日,8B端侧写作智能体AgentCPM - Report开源。它以端侧模型为核心,实现本地化部署与SOTA性能双重突破,亮点在于极致效能、本地安全保障,在多评测基准表现出色,部署便捷,两大创新支撑其优秀性能。

InfoQ
开源动态8

DeepSeek又拿第一!首创「因果流」视觉推理,超越Gemini

DeepSeek开源DeepSeek - OCR2,引入DeepEncoder V2视觉编码器,打破传统模型扫描限制,模仿人类视觉「因果流」逻辑。它解决了传统VLM忽略图像语义结构问题,在多项测试中表现出色,还验证了「LLM作为视觉编码器」可行性。

新智元
开源动态7

AgentIF-OneDay 发布,评估全场景长时复杂任务

红杉中国 xbench 发布 AgentIF - OneDay 评测体系,用于评估大模型解决复杂任务的能力。该体系从任务复杂度新视角出发,沿 Scaling Context 和 Scaling Domain 推进,构造了三类典型任务进行测评,揭示了主流 Agent 的能力边界。

特工宇宙
新闻资讯8

1秒30000元,台积电的光刻机,就快“冒烟”了

1月15日台积电公布2025年第四季度财报,营收、净利同比大增,预计2026年营收增近30%。先进制程营收占比高,HPC贡献大,2nm量产等或改变营收分布,先进封装贡献将提升,资本支出也将增加。

芯师爷
算法论文8

TPAMI | DC-SAM:打破SAM交互限制,基于循环一致性的图像与视频上下文分割方法

北京邮电大学联合南洋理工大学等机构发表论文,提出 DC - SAM 框架及 IC - VOS 基准。DC - SAM 含特征融合、正负双分支循环一致性提示生成等部分,实验在多基准测试获 SOTA 性能,为视觉大模型落地提供方案。

机器之心
算法论文7

腾讯LLM团队:对下一个 Token 预测的深入剖析,多样性 or 精准度?

最新研究证实RL能增强LLM推理,但成效受限预训练token分布。腾讯LLM部把交叉熵重写成单步策略梯度,用超参压熵,为RL打造‘低熵高信号’起点,经实验验证低熵模型优势明显。

PaperAgent
算法论文8

工业级文本转SQL新思路:成本暴降、超3000列超大数据库依然稳健

华中科大与复旦联合发布AutoLink框架,引入自主智能体,模拟人类工程师工作流。在不输入全量数据库模式下,实现对超大规模数据库模式的高精准链接与筛选,以低Token消耗刷新两大榜单纪录。

AIGC开放社区
产品应用7

用户痛点发现器

用户痛点发现器是个Web应用,能从社交媒体自动发现用户核心痛点,支持聚类分析和AI产品方案生成。它可输入关键词抓取抖音视频和评论,用GLM-4.6模型分析,还有优先级评分等系统。

GitHubStore
新闻资讯7

苹果重磅官宣谷歌Gemini 将支持 Siri,OpenAI 被边缘化?马斯克比奥特曼还急:这不合理!

苹果和谷歌达成多年合作协议,下一代 Apple Foundation Models 将基于谷歌 Gemini 模型及云技术构建,为 Siri 等功能提供核心支持。此合作引发行业讨论,马斯克质疑权力集中,也影响了 OpenAI 在苹果生态的角色。

AI前线