95后团队」共找到 5034 篇相关文章

开源动态8

Qwen紧追OpenAI开源4B端侧大模型,AIME25得分超越Claude 4 Opus

Qwen团队深夜开源两个端侧模型Qwen3 - 4B - Instruct - 2507和Qwen3 - 4B - Thinking - 2507,尺寸对端侧友好,支持256k上下文。者在AIME25测评得分超Claude 4 Opus,两模型能力较前作均有提升。

量子位
算法论文8

提速79%!上交大新方法优化企业级AI流程调度 | IEEE ICDCS’ 25

上海交通大学朱怡飞教授团队联合江行智能提出调度框架LLMSched,解决复合LLM应用任务运行时长和结构不确定问题。该框架重构DAG模型,用贝叶斯网络和熵减机制优化调度,实验显示最多降79%平均任务完成时间。

量子位
新闻资讯7

「硅谷大乱」小扎挖人细节来了:4年总包3亿美金,第一年可直接获得1亿美金,被OpenAI多人拒绝

为组建Meta超级智能团队,挽回Llama4失败局面,扎克伯格简单粗暴挖人,开出四年总包超3亿美元、首年到手1亿的薪酬,还提供领先算力。至少10名OpenAI员工拒绝,这撕裂了硅谷“使命驱动”文化。

AI寒武纪
算法论文8

AI打假AI,拿下SOTA丨厦大&腾讯优图

厦门大学联合腾讯优图实验室团队提出AIGI - Holmes方法,创新性采用“大模型+视觉专家”协同架构,解决现有AIGI检测技术瓶颈,在检测、解释能力及鲁棒性评估上均取得最优效果。

量子位
算法论文7

1万tokens是检验长文本的新基准,超过18款大模型集体失智

Chroma团队研究发现,将上下文扩展至1万tokens,18款主流大模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。

量子位
算法论文8

Meta-Think ≠ 记套路,多智能体强化学习解锁大模型元思考泛化

上海交通大学等团队提出ReMA框架,将复杂推理解耦为元思维和推理智能体,通过迭代强化学习协作。在单轮实验中,ReMA在多基准测试表现优;多轮实验虽有提升但不稳定,需进一步探索。

机器之心
新闻资讯7

Figure机器人分拣快递新视频曝光,网友:太像人类

Figure 02机器人开启打工模式,创始人放出其分拣快递新视频,它动作流畅像人类,由端到端通用控制模型Helix自主驱动。此前它还在宝马生产线连续20小时轮班作业,Figure与OpenAI分道扬镳推出Helix。

量子位
算法论文8

攻克「恶意投毒」攻击!华南理工联合霍普金斯和UCSD,连登TPAMI、TIFS顶刊

华南理工大学计算机学院AI安全团队联合国际高校,聚焦联邦学习中防范恶意投毒攻击。提出FedID和Scope两种创新防御方法,前者用多种度量标准和动态加权检测恶意梯度,者通过逐维归一化等揭示门维度,均有良好效果。

新智元
开源动态7

Mem0,用LLM给智能体解决记忆问题,开源

大模型训练知识和记忆不再增加,智能体记忆能力发展不理想。国外Mem0针对AI记忆技术发表论文并开源,提出Mem0和Mem0g两种方案,在不同场景表现出色,已获多应用,还提供SaaS服务。

AI与安全
开源动态8

视频生成比播放还快:开源VDN-H3,14秒视频11秒搞定

近期,网络出现“无限流”视频,源于MiniMax H3。OpenVDN团队开源Video Delta Net(VDN),基于MiniMax H3使视频生成速度提升75到90倍,14.4秒的768p视频11.23秒就能生成。它采用混合思路,性能提升显著。

AI工程化