人类在环」共找到 8738 篇相关文章

新闻资讯7

2025上半年大模型使用量观察:Gemini系列占一半市场份额,DeepSeek V3用户留存极高

推特博主「karminski - 牙医」基于OpenRouter数据,分析2025年上半年大模型API市场,涵盖总Token使用量、市场份额、细分领域用量、API接口使用趋势等,得出各模型表现及市场格局的观察结论。

Founder Park
产品应用8

DeepSeek-V3.2-Exp:用稀疏注意力打破长文本效率瓶颈

NLP领域,处理长文本时传统注意力机制效率低。DeepSeek团队推出DeepSeek-V3.2-Exp模型,引入稀疏注意力机制,保持性能同时提高长文本处理效率,降低计算复杂度,多基准测试中表现良好。

CourseAI
算法论文8

夜间感知新突破!北航等提出红外主导的高效目标检测方案 | ECCV'26

复杂视觉场景中,传统RGB - IR多模态检测方法低照度等场景下因RGB退化影响检测效果。北航等团队提出的InfraNet,以红外为主,用质量感知机制控制RGB引导,多数据集取得强竞争力结果。

新智元
算法论文8

ICSE 2026杰出论文 | 突破代码模型真实工程落地瓶颈,北大团队提出SEAlign对齐框架:显著提升软件工程智能体决策质量

现有代码模型经典基准表现好,但真实软件工程境表现差。北大金芝、李戈团队提出 SEAlign 框架,通过识别与对齐智能体轨迹关键决策点,提升模型真实工程任务表现,成果获 ICSE 2026 杰出论文奖。

机器之心
开源动态8

Hugging Face开源nanoVLM,750行代码可训练视觉语言模型,简单到令人发指!

Hugging Face开源全新视觉语言模型框架nanoVLM,仅750行代码就能从零训练高效能VLM模型。它单张H100 GPU训练6小时后,MMStar数据集准确率达35.3%,且能免费Google Colab跑。

AGI Hunt
开源动态8

港大开源ViMax火了,实现AI自编自导自演

香港大学黄超教授团队开源ViMax框架,GitHub获高星标。它借助多智能体协作实现AI自编自导自演视频,突破主流模型长视频制作的瓶颈,采用多种策略应对技术挑战,不过多方面仍有提升空间。

机器之心
开源动态8

Qwen3深夜开源新系列:文本表征模型,3种尺寸可选,超越商业API拿下SOTA

Qwen3深夜上新Embedding系列,专为文本表征等任务设计,Qwen3基础模型上训练,有0.6B/4B/8B三种尺寸,8B版本MTEB榜单排第一,性能超商业API,已多平台开源。

量子位
算法论文8

深入感知级别图像理解:UniPercept 统一图像美学、质量与结构纹理感知

多模态大语言模型语义级任务表现卓越,但感知级图像理解有短板。上海人工智能实验室等机构联合发布 UniPercept,构建感知属性定义系统与基准测试集,训练强基准模型,多方面表现超现有顶尖模型,应用潜力大。

机器之心
推荐文章7

Python 2还能走多远?

自2020年Python 2停止维护,虽仍有项目用,但企业和社区都向Python 3迈进。文章介绍了Python 2的发展历程、存的问题,阐述Python 3的优势,并给出了从Python 2切换到Python 3的方法。

腾讯技术工程
新闻资讯7

反超Nano Banana!OpenAI旗舰图像生成模型上线

OpenAI发布图像生成模型GPT - Image - 1.5,有更严谨指令遵循、精确编辑等亮点,速度快4倍。玩法类似Nano Banana,指令遵守和精确编辑上有提升,将ChatGPT面向所有用户推出,价格下降。但世界理解能力上遭质疑。

量子位