95后团队」共找到 5039 篇相关文章

开源动态9

SGLang 的 DeepSeek-V4.1 Flash Day 0 优化实录:4×B300 上 BS=1 达到 764 tokens/s

本文是SGLang团队的DeepSeek-V4.1 Flash Day 0优化实录,详解了架构适配、KV cache压缩、kernel优化到DSpark适配全流程,公开4×B300 GPU实测吞吐数据,附复现代码与步骤

GiantPandaLLM
算法论文7

Transformer上限触顶,Mobius能否引发下一代模型架构的革命?

自ChatGPT问世,Transformer上限备受关注。前OpenAI、Google负责人称其走到尽头。国内改进架构受算力限制。上海人工智能实验室的书生Mobius团队提出分离知识与推理的架构,有望解决商用等关键问题。

机器之心
开源动态8

一句话生图要过时了?开源图像生成Agent进化出「工具编排」

来自多机构的研究团队提出GenEvolve,将开放图像生成建模为「工具编排轨迹」。它配置三类工具,经多轮决策完成生成。通过构建数据集训练,实验显示在多基准上表现出色,已开源模型、代码等。

机器之心
新闻资讯7

实锤!GPT-5.5「降智」被抓,OpenAI官方文档认了

近期,网友发现GPT - 5.5使用一两个小时突然变傻、质量下降,开发者经测试实锤系统会静默切换模型。Plus和Pro用户均受影响,此前GPT各版本升级也常引发“降智争议”。

新智元
算法论文8

CVPR 2026 Oral|横扫室内3D场景,港科大(广州)打造单目开放词汇占据预测新SOTA

具身感知核心难题待解,传统占据预测方法有局限。港科大(广州)陈昶昊教授团队提出 LegoOcc,首次实现单目开放词汇三维占据预测,在多方面展现优势,未来或让家用机器人精准定位目标。

机器之心
算法论文8

ICLR 2026|人大&通义:别再只会堆上下文了!IterResearch用40K上下文轻松实现2048轮交互不退化

中国人民大学与阿里巴巴通义实验室团队提出 IterResearch 迭代式深度研究范式。它能让 Agent 在 40K 上下文下完成 2048 次工具交互且性能不衰减,解决了传统范式上下文臃肿问题,论文已被 ICLR 2026 接收。

机器之心
算法论文8

智能体如何学会「想象」?深度解析世界模型嵌入具身系统的三大技术范式

长期以来具身智能系统缺预测力,世界模型让智能体有了‘想象’未来的能力。中科大等机构团队综述将现有研究划分为模块化、顺序、统一三大架构集成范式,并指出未来研究方向。

机器之心
产品应用8

阿里发了个简历AI神器,大小仅0.6B

阿里巴巴集团研究团队开发出基于布局感知的简历解析框架,在简历解析任务准确率逼近Claude - 4等顶尖大模型,处理仅需1 - 2秒,直击自动化简历解析痛点,已在阿里HR系统全面部署。

量子位
推荐文章7

为什么 AI 喜欢用破折号

文章探讨AI爱用破折号的原因。AI常用“delve”源于非洲导师打分偏好,但破折号并非如此。作者发现这一现象在GPT - 4凸显,原因或为AI公司用旧书训练,使AI继承旧时代写作风格。

宝玉AI
新闻资讯7

我为马斯克扮演机器人!擎天柱背竟是最贵「演员团」

外媒揭秘特斯拉擎天柱靠人工数据训练。在实验室,员工重复日常动作,由摄像机记录。工作体力消耗大,要求严格,团队曾超百人,还裁掉部分人员。虽马斯克看好,但实际仍在靠人力蹒跚学步。

新智元