「构建方法」共找到 3230 篇相关文章
姚顺雨腾讯首篇论文:给AI下半场指路“上下文学习”
姚顺雨入职腾讯后首个成果CL - bench,用来测试大模型“从上下文中学习”能力。研究指出当下模型多依赖“过去”知识,无法适应“当下”学习。评测中,十个前沿模型表现不佳,揭示其真实场景应用缺陷。
Clawdbot 教程 01:模型的配置和切换
作者分享 Clawdbot 模型配置和切换教程,指出配置核心问题是命令行配置与 URL 修正,可用 openclaw configure 命令,不行则手动改配置文件,还介绍模型切换、避免 no output 问题等方法。
ClawdBot传疯了!视频教程来了
外网疯传的ClawdBot由开发者Peter Steinberger开发,能通过多平台交互干活。介绍其技术架构、两种设置方式、成本,还有安全设置、测试方法、进阶功能、使用场景及硬件选择等。
告别传统 Text-to-SQL:基于 Spring AI Alibaba 的数据分析智能体 DataAgent 深度解析
企业数字化转型中,业务人员受 SQL 语法限制,Text-to-SQL 也有不足。DataAgent 基于 Spring AI Alibaba 生态而生,能输出带图表、逻辑和洞察的报告,还通过多项核心技术解决企业数据决策难题。
视觉模型既懂语义,又能还原细节,南洋理工&商汤提出棱镜假说
南洋理工与商汤团队提出 Prism Hypothesis(棱镜假说)与 Unified Autoencoding(UAE)。论文指出视觉基础模型中语义理解和像素保真很难兼得,用频率谱统一视角解决冲突,UAE 实验效果良好。
ViT一作盛赞:这个中国开源“PS模型”强过Nano Banana
ViT核心作者Lucas Beyer连发三条帖子怒赞通义千问发布的开源模型Qwen—Image—Layered,认为这是图像生成的正确打开方式。该模型可实现PS级拆图自由,支持精细化修改图片元素,核心技术是端到端的扩散模型。
最新最完整的Agent Memory综述!
《Memory in the Age of AI Agents: A Survey》由多顶尖机构联合发布,对AI智能体记忆机制系统梳理。从形式、功能、动态维度厘清AI记忆本质,提出构建下一代强人工智能的蓝图。
刚刚开源就爆火,轻量快速,GB 大文件都秒开!
文章介绍刚开源就爆火的文本编辑器Fresh,它基于Rust语言,目标轻量、快速、功能强大,支持多平台。有上手0门槛、轻量快速等特性,还给出多平台安装方式和基本使用方法,值得开发者尝试。
图灵奖得主LeCun最后警告Meta!我搞了40年AI,大模型是死路
图灵奖得主Yann LeCun预计将很快离开Meta。因Meta风向转变,LeCun失势。他投身AI研究40年,认为大语言模型是死路,世界模型才是未来,或为此离开Meta并计划创业。
清华团队:1.5B 模型新基线!用「最笨」的 RL 配方达到顶尖性能
清华团队用两个 1.5B 模型证明,用最基础的 RL 配方可达到小模型数学推理能力 SOTA。单阶段训练加固定超参数实现 SOTA 性能且省一半算力,训练曲线还很平滑。