云的形状」共找到 10741 篇相关文章

算法论文8

微软:DeepSeek-R1等推理模型循环原因找到了

前几天,DeepSeek - R1论文更新,披露诸多细节。重点是推理模型在低温/贪心解码下易循环,根源是学得不对,如风险规避式复读、时序相关错误复读,还给出解决方案。

PaperAgent
产品应用7

人类遗忘难题解法,被GPT-5重新找出来了

GPT-5 Pro从埃尔德什问题定位到关键文献,发现该“未解决”数学难题早在2003年已被解决。此前网友曾热烈讨论此问题,此外,有教授称GPT-5 Pro能快速发现论文漏洞。

量子位
算法论文7

SceneWeaver:面向通用三维环境生成反思型智能体框架

室内场景合成在具身智能兴起下愈发重要,现有方法存在局限。BIGAI提出SceneWeaver框架,通过基于工具迭代优化统一多样场景合成范式,具有高保真模拟、强健物理交互等优势。

带你学AI
新闻资讯7

忘掉大模型,微软实证:小模型才是Agentic AI未来!

过去两年大模型在数学竞赛题上靠Test - Time Scaling发展遇天花板。微软rStar2 - Agent让14B小模型学会‘写代码→跑结果→改思路’,表现出色。还介绍了其基础设施、算法、训练配方等方法。

PaperAgent
开源动态8

刚刚,智谱开源了他们最强多模态模型,GLM-4.5v。

智谱接连开源GLM - 4.5和GLM - 4.5V,后者为多模态模型,总参数106B,在42个评测基准中41个达到SOTA。经测试,它视觉推理强、速度快,还有视频理解等功能,API定价良心,体现持续开放精神。

数字生命卡兹克
算法论文8

上下文工程(Context Engineering)综述:大模型下一个前沿

文章提出“上下文工程”学科,通过整合1400余篇论文构建“基础组件 - 系统实现”框架。它将上下文定义为动态结构化信息集合,揭示LLMs理解强于生成矛盾,为AI研究指明方向。

深度学习自然语言处理
开源动态8

本周 5 个火火火Github开源项目,每个都很有说法!

本周介绍5个Github开源项目。ai - berkshire将投资大师方法论系统化;stremio - web聚合视频资源;archify能将大白话描述变成架构图;Maple - font是优化编程字体;Netcatty整合SSH客户端等功能。

开源先锋
推荐文章8

Karpathy又封神!掀翻RAG,把你笔记变成第二大脑

前OpenAI创始成员Andrej Karpathy提出让大模型把笔记「编译」成持续生长活Wiki,替代RAG。他将笔记当源代码,LLM当编译器,实现知识结构化。此方案降低维护成本,解放人类注意力。

新智元
产品应用7

豆包推出专业版,能成为你「工作搭子」吗?

6月24日,豆包发布基于最新豆包2.1系列大模型专业版,新增Agent驱动办公任务模式,支持理解目标、拆解任务等。它回应了用户需求分化,还改变评价标准,有望成生产力入口。

AI科技评论
新闻资讯7

CNCF 警告:仅靠 Kubernetes 不足以保障 LLM 工作负载安全性

原生计算基金会(CNCF)指出,企业在 Kubernetes 上部署大语言模型(LLM)存在安全缺口。Kubernetes 无法理解或控制 AI 系统行为,需增加额外控制层,引入 AI 特定控制。

InfoQ