「非推理任务」共找到 4104 篇相关文章
Claude降智实锤了!还变相涨价,Opus跌下神坛
AMD高级总监审计发现Claude处理复杂任务能力变差,第三方跑分排名下降。官方称调整是为平衡速度与成本,但用户认为是变相降智。此外,企业包月套餐涨价,而Anthropic将推Opus 4.7和新设计工具。
以史为鉴:从互联网泡沫到英伟达五万亿
文章回顾互联网发展历程及泡沫破灭影响,对比当下AI浪潮,指出英伟达成首家市值破五万亿美元公司。探讨AI是否为泡沫,认为其未来发展或类似互联网,还分析英伟达走势及国产GPU替代、AI边缘推理领域前景。
工具增强的多模态LLM综述
多模态大语言模型(如GPT - 4V)虽有强大图文理解能力,但受数据稀缺、复杂任务表现不佳和评估标准不统一限制。论文提出为MLLM集成外部工具,构建全景图,覆盖多维度,还指出挑战与对策。
刚刚,OpenAI通用智能体ChatGPT Agent正式登场
北京时间周五凌晨,OpenAI发布全新ChatGPT Agent,实现通用智能体能力关键升级。它能自动用多种工具规划,完成复杂任务,已向部分订阅用户开放。其整合多能力,配备工具,基准测试表现佳,但也有安全风险。
OpenAI公开62页核心手稿!AI连破十大「菲尔兹奖级」难题
OpenAI公开62页核心手稿,展示GPT对十大「菲尔兹奖级」数学难题的完整推演,涵盖高维球体堆积、非sofic群构造等。仅花2000美元Token成本,引发全网热议,被指或为GPT - 6,强化学习大佬称像“奇点前夜”。
T-PAMI|中国科大、合工大等提出CAPER++:让关节物体位姿感知真正迈向「又快又稳」
在具身智能发展下,关节物体位姿感知难题待解。中国科大、合工大等团队提出 CAPER++ 框架,从关节驱动视角建模,将位姿学习拓展至 SE (3) 流形切空间,实现端到端推理,兼顾精度、鲁棒性与实时性。
LM Studio宣布支持在Mac上跑Qwen3-Next 80B模型
LM Studio宣布支持基于MLX框架在Mac上运行阿里Qwen3-Next 80B模型。该模型虽总参数量达800亿,但每次推理仅激活30亿。第三方评测显示其4bit量化运行效果好,不过实现GGUF格式支持尚需时间。
挖掘注意力中的运动线索:无需训练,解锁4D场景重建能力
香港科技大学(广州)与地平线团队提出VGGT4D,通过分析VGGT内部机制,利用注意力层运动线索,提出无需训练框架,在动态物体分割等任务表现优异,为低成本4D重建提供新思路。
用两个简单模块实现分割理解双重SOTA!华科大白翔团队等推出多模态新框架
华中科技大学和金山办公团队联合提出语义增强特征提取器(SEFE)和交错局部视觉耦合(ILVC)模块,构建多模态大模型LIRA,解决现有模型分割不精确和理解有幻觉问题,在分割和理解任务上达SOTA。
24张图,从GPT-2到gpt-oss,看OpenAI开源模型技术演进
2025年8月OpenAI释出gpt-oss-20b与gpt-oss-120b两个开源权重模型。文章梳理了从GPT - 2到gpt - oss的技术演进,拆解关键创新点,对比了与Qwen3的差异,介绍训练推理细节、实测体验及与GPT - 5跑分对比情况。