1.5B模型」共找到 9128 篇相关文章

算法论文8

南大团队直击大模型高分神话:人类90分,最强模型仅49分

南京大学傅朝友团队在Google Gemini评测团队邀约下推出视频理解新基准Video - MME - v2。它有创新的分层能力体系与组级非线性评分,经超3300人工时标注。评测显示模型与人类差距大,还揭示传统Acc指标虚高、‘Thinking’并非总增益等现象。

新智元
算法论文8

Kimi新架构让马斯克叹服!17岁高中生作者一战成名

17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术可让模型“回头看”,经Kimi Linear 48B模型验证,训练效率提升25%,推理延迟增加不到2%。

量子位
产品应用7

新手入门 | 搭建 AI 模型开发环境

文章为新手提供AI模型开发环境搭建方法,涵盖安装显卡驱动、CUDA、cuDNN、Miniconda、PyTorch、Transformers等,还介绍用Modelscope下载加载模型、PyCharm配置及解决常见问题。

机器学习AI算法工程
产品应用7

一家营收千亿美元的公司,如何回应 AI 落地的策略问题

2025年9月19日,Qwen3和DeepSeek v3.1上线Amazon Bedrock。该产品秉持“Choice Matters”理念,为不同业务选适配基础模型,上架超二百余款模型。亚马逊云科技副总裁总结选模型要点,其策略影响AI落地进程。

InfoQ
新闻资讯7

新榜单CompileBench:让AI能搞定22年前的老代码

近日,CompileBench 测试 19 个 AI 模型编译真实代码能力,最难任务是复活 2003 年代码并交叉编译到 Windows 和 ARM64。不同模型表现不同,如 Claude Opus 4.1 成功完成 ARM64 静态编译,各模型有不同优缺点。

AI工程化
算法论文7

AI在「赚钱锦标赛」夺冠,比人类还会做生意!躺赚时代要来了?

研究人员提出自动售货机运营模拟环境Vending - Bench,测试大模型智能体管理业务能力。实验显示不同大模型性能方差大,Claude 3.5 Sonnet净资产表现最佳,人类基线在可靠性上表现较好,各模型长周期表现波动大。

新智元
新闻资讯7

谷歌神秘模型Kingfall泄漏!

近日,谷歌AI模型Kingfall在AI Studio平台短暂开放后意外曝光。它具备多模态处理能力,上下文窗口6.5万个token,有两种模式。生成SVG矢量图能力超Claude 4,身份猜测不断。

AI工程化
产品应用8

谷歌最强具身大脑发布!波士顿机器狗瞬间人模人样

Google DeepMind发布机器人推理模型Gemini Robotics - ER 1.6,搭载它的波士顿动力机器狗能精确读仪表数字。该模型是第三代,在空间推理等方面显著提升,还新增读仪表能力,且是谷歌迄今最安全的机器人模型

量子位
算法论文8

NeurIPS2025 Spotlight | RobustMerge: 多模态大模型高效微调模型合并的全新范式

中科院、中山大学、北大团队针对高效微调模型合并难题,提出「方向鲁棒性」概念,揭示 PEFT 模块合并失败主因,给出 RobustMerge 解决方案,提升性能,成果开源。

机器之心
新闻资讯8

中国AGI深度时刻!杨强、唐杰、林俊旸、姚顺雨大咖们2026开年重磅交锋

2025年中国开源模型表现出色,AI大模型探索新范式。AGI - Next前沿峰会嘉宾探讨AGI发展,指出大模型To C与To B市场逻辑分化,还谈及自主进化、智能体变革及中国AI发展路径等问题。

AIGC开放社区