「对比实验」共找到 1727 篇相关文章
NeurIPS 2025 Spotlight | PhysX-3D:面向真实物理世界的3D资产生成范式
论文由南洋理工大学 - 商汤联合研究中心 S - Lab 及上海人工智能实验室合作完成,提出首个系统性标注的物理基础 3D 数据集 PhysXNet 及扩展版 PhysXNet - XL,还提出 3D 生成框架 PhysXGen,实现从图像到真实 3D 资产的生成。
马斯克星舰试验再创历史!3次爆炸3次推迟终成功,顺利完成太空载荷部署
美国中部时间26日晚,马斯克星舰第十次发射试验圆满成功。此次采用B16+S37组合,历经助推器返回、载荷释放、太空再点火等环节,虽过程波折,多次推迟和爆炸,但终达成目标,向太空探索迈进。
LLM-based Reranker效果到底如何?一项关于SoTA模型的全面分析
在信息爆炸时代,重排序是信息检索系统核心。论文对22种重排序方法实证研究,构建无污染数据集FutureQueryEval。结果显示LLM重排序器泛化能力被高估,轻量级模型有优势,为研究和应用提供指南。
实测DeepSeek V3.1,不止拓展上下文长度
文章实测了DeepSeek V3.1和V3,发现V3.1在编程、写作、翻译等方面有变化,如编程更全面、写作风格变文艺等。网友测试其在aider得分71.6%成非推理模型SOTA,但线上API有问题。
简单即强大:全新生成模型「离散分布网络DDN」是如何做到原理简单,性质独特?
本文作者杨磊介绍全新生成模型离散分布网络DDN,它建模目标分布机制简洁独特,有零样本条件生成等特性。文中详述其原理、网络结构、损失函数,还展示实验效果,最后给出未来研究方向。
竞购 Chrome,正面竞争 OpenAI,Perplexity 为什么要做 AI 浏览器?
今年 Perplexity 推出 AI 原生浏览器 Comet,OpenAI 也计划发布浏览器,Perplexity 还出价 345 亿美元收购 Chrome。文章梳理了 Perplexity CEO 观点及 a16z 测评,介绍 Comet 特点、目标、优势,还对比了 Comet 与 Dia。
12.4K 标星!开源AI编程神器 Dyad,v0、Bolt的开源平替!
AI 编程领域的 v0、Lovable、Bolt 等平台虽降低开发门槛,但有联网、隐私等问题。开源项目 Dyad 可作其替代方案,支持本地运行、多模型,能与 IDE 等集成,已获 12.4K 标星。
只提升2个点?我实测Claude 4.1后,发现官方在骗人
官方更新Claude 4.1,作者实测其与Claude4、DeepSeek R1在生成UI设计图、卡片、网页游戏开发等方面的能力。结果显示Claude 4.1进步大,尤其在理解提示词和视觉设计能力上,还能精细修改多文件。
MCP高手进阶【一】:彻底弄懂生命周期管理器(Lifespan)的机制与用法
文章深入解读MCP SDK开发高级技巧,聚焦生命周期管理器(Lifespan)机制与用法。先介绍Python上下文管理器,再讲FastAPI的lifespan,接着说明MCP Server的使用流程,最后分析不同传输模式下的工作方式。
附部署代码|云数据库RDS 全托管 Supabase服务:小白轻松搞定开发AI应用!
本文展示借助 RDS Supabase 搭建 AI 应用的全流程,对比传统开发,其在效率、成本、扩展性上优势显著。介绍 Supabase 特性、适用场景、核心能力,还给出基于它开发简易 Agentic RAG 应用的步骤。