「反中位数」共找到 3040 篇相关文章
“交互式Scaling”:增加Agent与环境交互的深度和频率来提升性能
在AI发展中,商业研究Agent是“黑箱”,开源研究Agent性能有差距。MiroMind团队推出MiroThinker v1.0,提出“交互扩展”提升性能,在多基准测试表现出色,也指出了当前版本的局限。
210亿美元的幻觉?奥特曼投了一家核能初创
AI热潮下,Oklo核能初创靠概念市值达210亿美元,投资人是奥特曼;而从SpaceX离职的工程师创立Quilter,让AI画电路板,几分钟完成工程师三天工作,二者代表造梦与造物两种姿态。
Meta通过简单算术解锁LLM SoTA性能
大型语言模型训练耗算力与时间,传统模型融合方法有局限。本文提出SoCE新方法,通过筛选专家模型、非均匀加权平均融合,在多评测中实现先进性能,为LLM优化提供新思路。
横扫硅谷的千问,杀回国内了
阿里Qwen模型获硅谷认可,Airbnb等公司盛赞。Qwen3 Max在投资大赛夺冠,多模型在各测试表现优异。11月14日阿里推千问APP,金沙江朱啸虎称其为中国ChatGPT,从多维度对比,千问表现出色。
360发布全球最强视觉语言对齐模型!榜单全面领先!
360发布FG - CLIP 2双语细粒度视觉语言对齐模型,几乎在所有数据集上全面领先。它能让AI在统一框架内看懂图像细节、理解中英双语,团队还提出新中文多模态评测基准。
美团开源全模态,比肩顶级闭源模型,开源新SOTA
美团LongCat团队发布5600亿参数开源全模态模型LongCat - Flash - Omni,它有端到端全模态架构,能实现毫秒级实时音频 - 视觉交互。该模型训练采用渐进式策略,工程上有高效技术支撑,在多基准测试表现出色。
已近2000亿美元注入,彭博社盘点2026年值得关注的24家AI初创公司
截至今年10月初,近2000亿美元注入人工智能初创企业。彭博社盘点2026年值得关注的24家AI初创公司,涉及模型开发、代码创作、实体智能等领域,还展现了AI产业思想分野。
AEPO:智能体熵平衡策略优化,让探索更稳,推理更深!
中国人民大学与快手团队联合提出 AEPO 算法,解决熵驱动式智能体强化学习训练不稳等问题。它设计两项核心机制,在 14 个基准上优于主流算法,在 X 等平台获高关注。
2篇论文,最新上下文工程技术一次性讲透!
上下文工程技术持续火热,文章分享10月两篇相关论文。ACE让模型给自己写「战术板」,在多任务表现优;SA - ICL让LLM先搭框架再做题,在化学/物理准确率提升显著,还对二者做了横向对比。
MetaAI解锁Transformer潜意识,仅额外3%计算开销,性能提升最高55%
Meta FAIR研究员François Fleuret提出《The Free Transformer》,对解码器Transformer扩展。它通过引入随机变量,让模型先计划后执行,用约3%计算开销,在编程等任务上性能提升最高达55%。