「模型使用经验」共找到 8935 篇相关文章
首次披露!DeepSeek V3 发布软硬一体协同训练论文,公开「降成本」秘诀
DeepSeek团队发布论文《洞察DeepSeek - V3:规模的挑战和对AI架构硬件的思考》,从硬件架构和模型设计双重视角,探索其经济高效的大规模训练和推理方法,介绍了设计原则、低精度驱动等多方面内容及降成本秘诀。
用GPT-6 Astra就能直接控制机器人?可具身真机没那么简单
本文讨论GPT-6 Astra接入机器人控制取得亮眼单项成绩,但真机测试暴露不安全不稳定问题,介绍穹彻智能发布的开源RoboRSI多智能体自进化框架,解决具身智能落地核心痛点,探讨大模型时代具身智能行业的发展方向
3亿用户的豆包,能做成办公生意吗?|甲子光年
6月24日,豆包专业版上线,三档定价68元到500元,搭配新模型等功能。它从C端聊天产品转向办公工具,但面临用户心智难改、价格较高等问题,其推出也将影响行业格局,加速C端AI产品免费时代终结。
出了两道真题考 GLM-5.2,Opus 4.8 和GPT 5.5 陪跑
作者对GLM - 5.2、Opus 4.8和GPT 5.5进行两项测试。一是审计Skill体系,GLM - 5.2覆盖skill数多、找出冲突多,还挖出bug;二是做世界杯夺冠推演器网站,Opus表现出色,GLM - 5.2省token,Codex有巧思但结构有缺陷。
AI第一金主黄仁勋:日均花掉20亿
AI投融资火热,黄仁勋成最大金主。过去财年英伟达投资175亿美元,今年已投400亿。投资风格是大手笔、广撒网,涵盖AI模型、算力、硬件等。偏爱OpenAI,投300亿,但与各实验室关系复杂,投资也有商业考量。
AI失忆症有了新解法,哈佛团队开发海马体仿生技术,要用AI终结人类“遗忘史”
近日,AI初创公司Engramme被曝正与投资者接洽融资约1亿美元,潜在估值达10亿美元。其联合创始人是哈佛教授加布里埃尔·克雷曼,技术基于其实验室成果,自研大记忆模型LMMs,已开放记忆API内测申请。
CVPR 2026|1分钟单图变4D视频!AI看图直接脑补物理规律
北京理工大学和理想汽车等团队提出全新框架PhysGM,引入DPO实现端到端快速前馈推理,能1分钟内将单图生成为4D动态视频,在速度和评价指标上超越主流模型,相关工作被CVPR 2026接收且代码已开源。
创业者出海必读,3 万字讲清 AI 产品达人营销全流程
本文作者有服务超百家AI agent产品团队出海经验,全面阐述AI产品达人营销全流程。指出其能解决产品增长难题,介绍海外博主生态,涵盖前期准备、内容适配、执行环节要点,还提及AI在其中的作用,强调建立长期合作关系。
陶哲轩:AI 已经把想法成本降到几乎为0了...
著名数学家陶哲轩在与播客主持人Dwarkesh Patel的对谈中分享使用AI一年后的观点,认为AI已将想法生成成本降至几乎为零,但验证和评估成新瓶颈,还探讨其对数学研究的影响及未来发展。
10w人看过的龙虾量化系统,评论区骂最多的问题,我花2天补上了。
上一篇龙虾量化系统文章获10w+,评论指出数据是短板。作者经研究找到QVeris,它是统一数据接口平台,使用简单。作者以金融领域为例介绍其用法,还测试其在其他领域的能力,认为它是AI时代的数据基础设施。