人在回路」共找到 8730 篇相关文章

算法论文7

2篇论文,最新上下文工程技术一次性讲透!

上下文工程技术持续火热,文章分享10月两篇相关论文。ACE让模型给自己写「战术板」,多任务表现优;SA - ICL让LLM先搭框架再做题,化学/物理准确率提升显著,还对二者做了横向对比。

CourseAI
新闻资讯8

刚刚,马斯克Grok 4.1低调发布!通用能力碾压其他一切模型

xAI 低调发布 Grok 4.1 并向所有用户开放,可多平台使用。该模型真实世界可用性上显著提升,尤其创造力等方面出色。它多项评估中表现优异,通用能力领先,情感智能、创意写作佳,还降低了事实幻觉。

机器之心
算法论文8

vivo突破手机AI部署难题,绕开MoE架构限制,骁龙8 Elite流畅运行|ICCV 2025

AI多模态时代,‘让大模型上手机’成焦点。现有MLLM手机端部署有难题,vivo AI研究院等团队提出GenieBlue方案,绕开MoE架构限制,骁龙8 Elite芯片手机流畅运行,保持语言性能同时实现多模态表现。

量子位
新闻资讯7

Anthropic最新研究:Claude正悄悄进化为“情绪价值大师”

Anthropic研究发现,Claude正成为“情绪价值大师”,们会面临情感挑战时向其寻求陪伴。它还使用Clio工具分析对话,保护隐私下了解使用情况。Claude情感陪伴与专业支持中扮演双重角色。

量子位
开源动态8

国产MiroMind智能体框架,登顶全球预测未来大模型榜单

国产MiroMind公司全球首个动态实时预测基准FutureX上夺冠,老板是陈天桥。其开源的MiroFlow v0.2智能体框架优势明显,能升级大模型能力,且成本低、可复现。MiroMind预测赛道领先。

AIGC开放社区
新闻资讯8

OpenAI杀疯了!内部神秘模型首次斩获信息学奥赛IOI 2025金牌,碾压98%类选手

OpenAI研究员官宣其内部研发的AI推理系统2025年国际信息学奥林匹克竞赛获金牌,超越98%类选手。该系统模拟类环境下靠推理解题,用通用模型,一年间成绩大逆转,近期多赛事表现出色。

AI寒武纪
开源动态7

Qwen拿半成品刷下AIME'25满分,给别留点面子吧……

开源之王Qwen的Qwen3“超大杯”推理版虽为早期预览版,仍训练中,但已AIME 25和HMMT25达100%准确率,超GPT - 5系列。该预览版可Qwen Chat免费试用,API已上线阿里云。

量子位
开源动态7

vLLM Ascend超越MindIE? 昇腾推理Qwen3与DeepSeek R1 Distill性能实测

国内开发者昇腾NPU上进行大模型推理面临挑战,华为MindIE推理引擎使用门槛高。昇腾联合vLLM社区推出vLLM Ascend插件。本文用GPUStack平台实测其与MindIE性能差异,得出两者不同场景各有优势的结论。

AI工程化
新闻资讯8

独家对话比尔·盖茨:AI已跨过临界点,社会却几乎没有讨论

比尔·盖茨与《麻省理工科技评论》的采访中表示,AI多方面已跨过临界点,但行业外缺乏讨论。他警告生物恐怖主义风险,提出‘类保留岗位’、征税等政策设想,也看好AI部分领域价值。

DeepTech深科技
算法论文8

重新思考RLVR中的熵正则:从探索不足到探索过度的破局之路

2024年以来,RLVR使大模型推理任务有显著突破,但实践中探索机制易失衡。传统熵正则化LRM场景易走向极端,研究团队提出SIREN方法精准调控探索,实验显示其多模型和数据集上性能提升显著。

深度学习自然语言处理