大模型部署」共找到 9430 篇相关文章

新闻资讯7

315曝光的“AI投毒”原理:GEO这样操控模型推荐

央视3·15晚会揭开AI“投毒”灰色产业链,利用GEO操控模型推荐。介绍了训练数据污染、检索上下文劫持、提示注入诱导攻击三种“投毒”技术,还阐述了内容生产、渠道投放、效果强化的产业链运转流程。

量子位
算法论文8

多模态模型持续学习系列研究,综述+Benchmark+方法+Codebase一网打尽!

近年来,生成式AI和多模态模型进展显著,但在动态环境下实现持续学习是挑战。中科院自动化所联合香港院AI中心系统性研究,提出综述、方法、Benchmark和Codebase,为相关人员提供全面支持。

机器之心
算法论文8

ICML 2026 | 只用少量Thinking Tokens,模型依然能深度思考

近年来,CoT 推理成为提升模型复杂问题求解能力的重要路径,但带来效率问题。浙江学等团队提出 Heima 框架,将冗长 CoT 压缩为少量 thinking tokens,在减少 token 数的同时保留推理能力,已被 ICML 2026 接收。

机器之心
算法论文8

LLM-in-Sandbox:给模型一台电脑,激发通用智能体能力

来自中国人民学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。

机器之心
算法论文8

推理路径的动态调控:让模型学会“恰到好处”的思考

当前模型推理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入推理过程,在多个STEM基准测试中缩减推理步骤、提升准确率。

深度学习自然语言处理
开源动态8

Qwen紧追OpenAI开源4B端侧模型,AIME25得分超越Claude 4 Opus

Qwen团队深夜开源两个端侧模型Qwen3 - 4B - Instruct - 2507和Qwen3 - 4B - Thinking - 2507,尺寸对端侧友好,支持256k上下文。后者在AIME25测评得分超Claude 4 Opus,两模型能力较前作均有提升。

量子位
新闻资讯7

Anthropic最强网络攻防模型Mythos,美国国安局早就一直在用了

美国政府准备向多个联邦机构开放Anthropic新模型Mythos的‘修改版’,虽国防部将Anthropic拉黑,但国安局一直在用Mythos。白宫先明确模型接入的权限、用途等边界,再推进接入,各方对其态度有分歧。

新智元
新闻资讯7

模型全员0分!谢赛宁领衔华人团队,最新编程竞赛基准出炉,题目每日更新禁止刷题

谢赛宁等人出题,让o3、Gemini - 2.5 - pro等模型全军覆没。LiveCodeBench Pro是实时基准测试,题库每日更新。此前称LLM编程超人类专家,本次测试并非如此,最好模型难题通过率也为0。

量子位
算法论文8

跳出「黑盒」,人刘勇团队最新语言模型理论与机理综述

语言模型工程成功但理论研究滞后,被视为「黑盒」。人刘勇团队用生命周期分类法,将LLM理论研究整合为六阶段,系统综述底层理论与机制,指出前沿挑战,为其向严谨科学转型提供路线图。

机器之心
新闻资讯8

史上首次!米兰冬奥基于阿里千问打造奥运官方模型

2月5日,国际奥委会主席柯丝蒂·考文垂宣布基于阿里千问打造奥运史上首个官方模型,已在赛务与公众服务双端落地。此外,自动媒体描述系统、AIGC技术等也有应用,阿里云多项技术助力米兰冬奥。

千问Qwen