中科大」共找到 6820 篇相关文章

新闻资讯8

惊天瓜!东土豪发「纯血」模型,背后底座竟是MiniMax?

沙特发布号称100%沙特血统的国家级模型HUMAIN M3,后被发现基于国MiniMax的M3模型。沙特用超1万亿阿拉伯语Tokens后训练,使模型在阿拉伯语赛道领先,代表国AI出海新形态。

新智元
推荐文章7

为什么堆算力救不了模型

文章指出模型和人类脑归纳规律路径不同,AI追求精确但脆弱的拟合,人追求粗糙但不变的压缩。模型在可收敛系统表现惊艳,不可收敛系统则崩盘,未来AI产品核心是打造可收敛封闭环境。

AI科技评论
新闻资讯8

年复出,入局模型

国产模型领域黑马StartLux-V1.0-27B-Preview,参数量仅27B,在信通院MCP测试排综合第二,仅次于1.6万亿参数量的DeepSeek-V4-Pro。其创始人陈年押注本地模型,公司专注该领域商业化。

量子位
算法论文8

230个模型在婴幼儿认知题上集体翻车!揭秘多模态模型的核心知识缺陷

ICML 2025研究揭示多模态模型在基础认知能力上表现不佳。研究者建测评题库CoreCognition测试230个主流模型,发现其存在核心知识缺陷,扩规模难补短板,还需补齐核心知识。

量子位
开源动态8

nanobot4,000行代码复刻Clawdbot

nanobot用4000行代码复刻Clawdbot,解决AI从‘被动回答’到‘主动服务’问题。它有核心架构Agent Loop,三主动触发机制,模块化设计,还坚持少即是多原则,让AI成自动化助手。

CourseAI
推荐文章7

人才济济的厂,为何频频产出垃圾代码?

厂常产出垃圾代码,原因在于多数代码变更由菜鸟工程师完成,他们经验不足且常处于摸索状态。老手虽有优势,但过度依赖有问题。厂为调度人才牺牲代码质量,这在AI时代隐患更

InfoQ
算法论文8

上交智能计算研究院论文:不只算对答案,模型如何真正学会运筹建模丨ICLR 2026

上海交智能计算研究院提出 StepORLM,通过生成式过程监督提升运筹建模可靠性。研究反思传统训练范式局限,在多数据集测试,小参数的 StepORLM 表现超型模型,还分析现有方法缺陷并提出解决框架,有重要方法论和应用意义。

AI科技评论
新闻资讯7

DeepSeek、GPT、Qwen,所有模型架构图都有,Karpathy:宝藏画廊!

模型赛道热闹,架构创新多,理解困难且缺清晰架构图。AI 研究者 Sebastian Raschka 绘制主流模型结构,整理成在线图谱「LLM Architecture Gallery」,方便研究者查阅对比。

机器之心
算法论文8

启发学习:让模型认知从外化到内生

当下模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能幅提升模型任务性能。

机器之心
算法论文8

AI 会笑吗?BIGAI & 上交团队:多模态模型是否真的能 get 到视频笑点|ACL 2026

上海交通学等团队构建v-HUB评测基准,分析多模态模型视频幽默理解能力。评测7个前沿模型发现,模型依赖文字、主动发现笑点能力弱,声音作用有限,还需考虑隐形线索。

AI科技评论