对比实验」共找到 1727 篇相关文章

算法论文8

十二大顶尖大模型决战华尔街与量化投资

文章解读重磅论文,该研究汇聚五家顶级AI厂商十二个大模型,在标普500指数十一大板块构建投资组合并测试。结果表明,混合智能策略是稳健收益最佳路径,未来量化投资是人机和量化模型三元融合。

AIGC开放社区
推荐文章7

极速开发出一个高质量 Claude Agent Skills 最佳实践

作者实践开发Claude Agent Skills积累经验分享。先介绍Skill概念,对比与MCP区别;再讲最佳开发实践,如借助AI、利用官方案例等;还给出Claude Skill自身设计、规范等方面的最佳实践及避坑指南。

阿里云开发者
推荐文章8

认知重建:Speckit 用了三个月,我放弃了——走出工具很强但用不好的困境

本文作者分享使用 Speckit 三个月的踩坑经历,探讨 AI 编程工具落地难题。介绍复合工程与上下文工程理念,提出 AI 工程化方案,对比传统工具,阐述其设计、落地策略及未来趋势,助力解决企业开发痛点。

腾讯技术工程
算法论文8

极简主义的胜利:清华团队用最简单的强化学习配方刷新1.5B模型纪录

清华、伊利诺伊大学和上海AI实验室团队提出JustRL架构,仅用单阶段训练和固定超参数,在1.5B模型上刷新性能纪录,计算量仅为复杂方法50%,挑战了复杂技术堆叠现状。

AIGC开放社区
产品应用7

Deepseek是被降智了吗?

作者认为Deepseek被降智,存在诸多问题,如不懂用户意图、长文理解差、措辞怪异、提示词调教难、无脑捧杀、幻觉率高、深度思考弱等,还对比了与GPT在人际交往话题回复上的差异。

深度学习自然语言处理
推荐文章8

2025 年最全面的 LLM 架构技术解析【长文】

Sebastian Raschka更新「大型LLM架构对比」长文,解析2025年LLM架构发展。介绍了如DeepSeek V3、OLMo 2、Gemma 3等模型架构特点,像DeepSeek V3用MLA和MoE提升效率,还探讨线性注意力复兴等趋势。

AGI Hunt
新闻资讯7

从"单芯作战"迈向"系统集成":产业变革背景与两大关键技术

随着摩尔定律逼近极限与AI算力需求爆发,集成电路产业正从‘单芯作战’迈向‘系统集成’。文章介绍Chiplet和SoW技术内涵、优势,对比二者差异,还提及中国‘软件定义晶上系统’技术路线及产业发展现状。

芯师爷
新闻资讯7

OpenAI公开新的模型训练方法:或许能解决模型撒谎问题,已在GPT-5 thiking验证

OpenAI公开名为“坦白”的模型训练方法,可解决LLM欺骗行为。该方法强制模型自我反省,“坦白”奖励与“主要回答”奖励分离。在GPT - 5 - Thinking上实验,能提升不良行为可见性,但对“无知的错误”有局限。

AI寒武纪
新闻资讯8

Gemini 3.0 登场后,哈萨比斯要「改造」Google 全系产品

Gemini 3.0登场引发热议,被视为Google近年最稳健升级。Google DeepMind CEO哈萨比斯谈其研发过程、团队推进能力等。新模型各方面提升显著,还将强化个性化、记忆等能力,Antigravity开发平台也备受关注。

AI科技评论
开源动态8

上交×蚂蚁发布 DiagGym:以世界模型驱动交互式医学诊断智能体

上海交通大学与蚂蚁集团等团队提出新训练框架,构建面向医学诊断的世界模型DiagGym,训练诊断智能体DiagAgent,还设计评测基准DiagBench。实验显示该框架下的智能体表现优于先进模型,代码等已开源。

机器之心