「业绩表现」共找到 2298 篇相关文章
Manus被收购,智谱也定了8天后上市
12月30日智谱启动港股招股,1月8日将挂牌上市,拟发售3741.95万股H股,每股116.20港元,预计募资43亿港元。其基石投资者认购近七成,技术以GLM为核心,模型表现出色,但上市后面临诸多挑战。
全面战胜ReAct!斯坦福全新智能体推理框架,性能提升112.5%
斯坦福和MIT团队推出新AI智能体推理框架ReCAP,在长上下文任务中全面超越ReAct,性能提升显著。它通过独特结构和三大机制解决大模型常见问题,虽成本增加,但在关键任务表现出色,潜力巨大。
多家芯片公司业绩飙涨,这个赛道彻底火了?
近期多家A股芯片公司Q3财报亮眼,受益于端侧AI推进。端侧AI优势多,吸引科技巨头布局,但落地有挑战。技术进步使大模型轻量化,手机与AI眼镜较热。其发展面临应用、技术、生态等问题,也有隐私保护方案。
打破数据质量鸿沟!清华腾讯Bee项目发布1500万高质量数据集,刷新MLLM全栈开源SOTA
全开源多模态大模型性能被闭源和半开源模型“卡脖子”,根源在于数据质量。清华与腾讯混元团队推出Bee项目,有三大核心贡献,产出的Bee - 8B模型表现领先,证明保证数据质量比堆量更有效。
十年来Python生态最好工具,引爆全社区的uv到底是什么?
uv是用Rust写的Python包和项目管理工具,被天文学家Emily L. Hunt博士赞为近十年Python生态最好的事。它功能强大,能替代多个工具,速度快,兼容性强,安装简单,还能轻松管理项目。
大模型是否对问题难度有预判?最新研究揭示 LLM 内部的“难度感知机制”
近期论文《Probing the Difficulty Perception Mechanism of Large Language Models》系统性解答大模型能否感知问题难度等问题。研究基于数据集在主流 LLM 上训练轻量线性探针,定位负责难度感知的注意力头,还发现不同模型表现有差异。
LLM 长文本处理的“不可能三角”?我们用 E2LLM 把它破解了!
长文本理解与推理是LLM的难题,存在效果、速度、兼容性的“不可能三角”。蚂蚁集团和华东师范大学提出E2LLM新范式,实现三者平衡,在效果和效率上表现出色,开启长文本处理新篇章。
没想到,32B清华DeepDive掀翻深度搜索全场的!
文章指出大模型在真实深网搜索场景表现不佳,核心矛盾是缺‘难搜’数据和多轮工具调用 RL。清华 DeepDive 用数据合成造‘难搜’题,端到端多轮 RL 训练,在 BrowseComp 刷新开源记录,迁移能力也强。
只需1/4预算,性能反超基线:阿里高德提出Tree-GRPO,高效破解智能体RL难题
阿里高德提出Tree - GRPO方法解决智能体RL难题。它以智能体步骤为节点树搜索,在11个数据集中更省预算、表现更好,能在1/4预算超GRPO基线,解决了Rollout成本高和监督稀疏问题。
告别「解码器饥饿」!中国科学院NeurIPS推SpaceServe,高并发克星
中国科学院计算技术研究所入选NeurIPS 2025的论文提出SpaceServe架构,将LLM推理P/D分离扩展至多模态场景,通过EPD三阶解耦与「空分复用」,解决MLLM推理行头阻塞难题,在Qwen2 - VL系列模型实测中表现出色。