「事实和信念」共找到 7000 篇相关文章

开源动态8

超越DeepSeek-R1,英伟达开源新王登顶!14万H100小时训练细节全曝光

英伟达Llama - Nemotron系列模型超越DeepSeek - R1且全部开源。论文揭秘其训练关键,如用合成数据监督微调与强化学习等。还介绍构建阶段、架构设计等,评估显示该系列模型在多任务表现出色。

新智元
算法论文8

AgentA/B:用AI模拟用户,真人AB测试或将成为历史

宾夕法尼亚州立大学和亚马逊合作研发AgentA/B测试框架,用大语言模型生成虚拟用户模拟真实行为,成本低、速度快,还能绕开真实流量测试。虽有人质疑,但它或改变传统AB测试。

AGI Hunt
算法论文8

睡觉也在卷!伯克利Letta新作「睡眠时计算」让推理效率飙升

Letta和UC伯克利研究者提出「睡眠时计算」技术,能让LLM在空闲时间提前思考以提升推理效率,降低推理成本,在多数据集实验中展现优势,在软件工程任务中也有应用。

新智元
算法论文8

LoRA中到底有多少参数冗余?新研究:砍掉95%都能保持高性能

这篇创新研究介绍了LoRI技术,证明即使大幅减少LoRA的可训练参数,模型性能依然强劲。研究团队在多个任务上测试了LoRI,发现仅训练LoRA参数的5%,LoRI就能匹配或超越其他方法的性能。

机器之心
算法论文8

Jev刷屏之后,竟然有人12个月前就提出了概率并行生成?

Jev刷屏引发AI面向决策输出的讨论,本文挖掘出香港中文大学徐强团队2025年9月就已提出显式概率、并行输出、面向决策的概率预测新范式,验证模型TimePrism以极简结构取得超越复杂模型的效果,思路与Jev异曲同工。

机器之心
产品应用9

华为GTS让Agent学会「看着网络排障」,双防火墙难题几乎全拿下

本文介绍华为GTS算法团队针对大模型Agent网络排障遇到的「拓扑失忆」痛点,提出NetCanvas方案,通过可交互视觉拓扑实现认知卸载,大幅提升复杂网络排障的准确率和效率。

量子位
产品应用9

实测 Seedance 2.5 vs 可灵 3.0,谁能让我们无痛当上视频导演?

本文通过两大真实创作测试场景,对比Seedance 2.5与可灵VIDEO 3.0两款热门AI视频模型的表现,分析二者在画面表现、分镜执行、合规风控上的差异,为创作者提供选型参考。

AI科技评论
开源动态8

一个被低估的Markdown神器!

本文是开源君分享的一款被低估的开源AI原生Markdown编辑器OpenKnowledge,它兼顾美观编辑体验、AI协作、本地存储,满足个人和团队知识管理需求,目前GitHub已收获4.1k Star。

开源先锋
开源动态7

Agent 下半场:真正能自进化的 Agent 应该是什么样的?

当下 Work Agent 难以稳定完成复杂长程任务,且经验无法沉淀。EvoMap 提出自组织蜂群架构,通过 AutoResearch 落地验证,探索 AI4AI 方向,构建记忆和连接的三层产品结构,推动 Agent 网络自进化。

特工宇宙
产品应用7

The Batch: 978 | DeepSeek-V4-Pro 更新了

DeepSeek发布旗舰模型DeepSeek-V4-Pro-0813正式版,性能提升,还发布开源agent harness开发者预览版并提价。模型在多指标表现佳,编码能力改进明显,公司公开基准测试框架意义大。

DeeplearningAI