推理大模型」共找到 9522 篇相关文章

新闻资讯7

Claude Opus 4.1代码实测惊人!OpenAI开源模型却只会写屎山?

昨日,OpenAI、谷歌和Anthropic等发布新模型。Anthropic推出Claude Opus 4.1,虽性能提升不,但编码能力获客户认可。实测显示Claude - Opus - 4.1写代码稳,OpenAI新模型表现不佳。

新智元
新闻资讯8

OpenAI挖到最新菲尔兹奖得主,字节刚出炉的科学家计划在瞄准谁?

今年菲尔兹奖得主之一Jacob Tsimerman将入职OpenAI安全部门。当下顶尖科学家流向头部模型公司,AI与前沿科学融合成趋势。字节发布Seed STEM科学家计划。模型下半场比拼基础研究,构建评测基准很重要。

机器之心
新闻资讯7

谷歌市值突破3万亿!重利好力推股价

谷歌母公司Alphabet股价周一涨,市值首破3万亿美元,成全球第四家达此成就的公司。近期谷歌反垄断案落定避免拆分,且其模型表现优异,驱动多业务转型,投资者信心增。

新智元
算法论文8

模型训练的不稳定性有望彻底解决,MIT新研究用谱正则化替代层归一化

MIT团队创造Lipschitz Transformer,用谱正则化替代层归一化,认为或解决训练不稳定根本原因。他们对比多种方法权衡,发现Muon + 奇异值裁剪推动权衡边界,且工作完全开源。

AGI Hunt
算法论文8

理解帮助生成?RecA自监督训练让统一多模态模型直升SOTA

统一多模态模型在视觉理解和生成能力上不平衡,常理解强但生成弱。本文提出重建对齐(RecA)自监督后训练方法,不改动架构,用未标注图像训练,在多模型实验中提升性能,部分达SOTA。

机器之心
新闻资讯7

Cursor滑跪开源技术报告:Kimi基模这样微调能干翻Claude

Cursor放出Composer 2技术报告力证‘自研’,基于Kimi K2.5经持续预训练和异步强化学习,测试表现好。同时,杨植麟分享Kimi团队最新思考,认为模型要规模化,断言模型训练进入第三阶段。

量子位
新闻资讯8

刚刚,DeepSeek论文登上Nature,更多细节披露!

9月17日,梁文锋担任通讯作者的DeepSeek - R1推理模型研究论文登《Nature》封面,它是全球首个经同行评审的主流LLM。不靠人工标注,靠强化学习激发推理能力,学会‘自我反思’,在多任务上优于传统模型

PaperAgent
产品应用7

京东广告模型实战:GRAM 架构如何在 50ms 内完成生成式推荐?

流量红利见顶,广告营销转型遇挑战。京东张泽华在会公开应对方案,介绍 GRAM 架构,实现意图与商品语义对齐,控制推理时延,解决冷启动等问题,还分享算法与知识工程实践。

InfoQ
算法论文8

模型外挂“三维物体知识库”来了,幅增强机器人长程自主操作能力

现有视觉语言模型(VLM)能让机器人理解指令,但在操作中缺三维空间知识。近日研究提出 RAM 框架,它像“三维物体知识库”,为 VLM 补充空间知识,经 14 项实验验证其操作能力,还探索了在铰接与柔性物体操作中的应用。

DeepTech深科技
产品应用8

模型测试不再跳来跳去,VS Code + Hugging Face = 真香

Hugging Face 发布新功能,让开发者在 VS Code 的 GitHub Copilot Chat 中直接接入 Inference Providers,可调用 Kimi K2 等开源模型测试,无需频繁切换平台。该功能有统一 API 等优势,定价门槛低。

InfoQ