深度学习模型训练」共找到 8620 篇相关文章

开源动态8

外卖公司也能搞AI?

昨天凌晨美团悄悄开源560B参数的MoE大模型LongCat-Flash-Chat,引发国外网友疑惑。该模型推理速度超100 tokens/秒,基准测试表现出色,多项设计解决实际问题,贴合美团业务需求。

AGI Hunt
算法论文8

AI“压力面”,DeepSeek性能暴跌近30% | 清华&上海AI Lab

上海人工智能实验室等团队设计REST框架,在一个prompt里抛多问题模拟复杂推理场景。结果显示,DeepSeek - R1等模型高压下性能大幅缩水,REST能拉开不同模型差距,还揭示评测方法局限。

深度学习自然语言处理
新闻资讯7

AI 精神病的巅峰:Claude Mythos 和 OpenAI Spud 还没上线,就有人度假都睡不着了

还未发布的Claude Mythos和OpenAI Spud在舆论场引发热议,大众情绪被拉高。OpenAI推出GPT - 5.4 - Cyber,还跟进‘安全’故事。网友对‘模型太危险只能少数公司用’说法存疑,同时GPT - 6等新模型消息不断。

InfoQ
推荐文章7

上下文工程的崛起:提示工程已是过去式

模型应用从简单问答转向复杂智能体系统,技术焦点正从提示工程转向上下文工程。上下文工程核心是为大模型提供恰当信息与工具,其重要性日益凸显,且与提示词工程有明显区别。

AI工程化
算法论文8

规范对齐:回答前的深思,让安全与行为边界更清晰

OpenAI等厂商将规范融入大模型。上海交大等团队提出规范对齐概念,构建评测基准SpecBench,揭示主流模型不足。探索测试时深思方法,如Align3,能提升模型规范遵循度,项目已开源。

深度学习自然语言处理
新闻资讯7

DSpark推理速度提升80%后,OpenAI宣布新方法将推理成本降低了一半

近日,OpenAI 工程师开发优化技术,将模型推理成本降一半。业内猜测或基于公开成果,也有人认为是模型量化。此前 DeepSeek 推出 DSpark,使 V4 模型推理速度提升 60%-85%,还引入峰谷定价机制。

AI科技评论
新闻资讯7

35天,版本之子变路人甲:AI榜单太残酷!

LMSYS榜单揭示大模型残酷现实,如Claude 3 Opus从榜首暴跌,大模型“霸主保质期”仅35天,这对应用层开发者是降维打击,未来生存要么做“游击队”,要么挖掘模型无法碾压之物。

新智元
算法论文8

爆火论文颠覆RL认知!「错误奖励」让LLM推理暴涨24.6%,学界惊了

最新爆火论文颠覆传统RL训练认知,华盛顿大学等团队证实「伪奖励」可让LLM推理性能提升。研究设置多种伪奖励形式实验,发现其对Qwen模型有效,但并非对所有模型都有效。

新智元
推荐文章7

Zed 为什么不用自己造 Agent?OpenAI 架构师给出答案:Codex 重划 IDE × Coding Agent 的分工边界

Coding agents 是应用型 AI 活跃领域,但团队常重复构建脆弱基础设施。OpenAI 的 Codex 提出“模型和 Harness 共同构建”,架构师介绍构建挑战与使用模式,还阐述了将模型适配到 Harness 的问题及未来发展方向。

AI前线
产品应用8

从0开始,在国内用上Claude Code的终极保姆教程来了。

作者应朋友要求,推出Claude Code小白教程。介绍其为优质Agent框架,适配多种模型,国内使用不封号。详细讲解Mac和Windows系统下的安装、接模型、启动步骤,还提及CLAUDE.md文件设置。

数字生命卡兹克