自证能力」共找到 4102 篇相关文章

算法论文8

除了prompting外,不动参数,如何改变模型行为?

文章指出传统提示工程控制大模型生成行为有缺陷,提出Steering Target Atoms (STA)方法。它用稀疏编码器分解LLM高维表示,定位“原子知识组件”精准控行为,实验效果超现有技术,还能控制推理长度。

深度学习自然语言处理
新闻资讯8

黄仁勋剑桥预言:当智力沦为商品,灵魂才是硬通货!

新智元报道,黄仁勋在剑桥领完「霍金研究员」奖后称,智力即将比来水还廉价,人类引以为傲的逻辑推演等很快会变得如水电般廉价。在「智力商品化」时代,审美、直觉和承担后果的勇气等无法被计算的能力才珍贵。

新智元
算法论文8

大模型如何"不训练"也能学习?——上下文学习的隐式权重更新机制

大型语言模型能通过上下文学习(ICL)在推理时即时学习新任务,无需修改模型参数。本文首次注意力层与MLP层组合能隐式将上下文信息转为MLP层低秩权重更新,解释了ICL原理,为构建AI系统开辟新路径。

深度学习自然语言处理
新闻资讯7

AI 进展的速度开始放缓了吗?

近期 AI 舆论场有三个微妙位移,失业讨论变少、股票讨论变多、进展讨论降温。其实 AI 进展可拆成叙事、能力、资本三个不同步的时钟,其整体速度未降,还给出截至 2026 年年中受冲击最大的十个行业清单。

AI Reading Hub
产品应用7

DeepSeek识图模式全量上线,却认不出家老板梁文锋

端午节前,DeepSeek全量推送识图模式。测试发现,它能认出黄仁勋,但忽略‘豆汁’字样,识别人物和潦草汉字准确率低,不过识别文物能力不错。还比较了与其他模型在乐理推理测试中的表现,开发者有新疑问待解答。

机器之心
新闻资讯8

陈天桥旗下AI公司MiroMind打造全球顶尖预测型大模型,性能登顶行业基准

全球首个动态实时LLM智能体未来预测基准FutureX推出,陈天桥旗下MiroMind团队连续两周蝉联冠军。其模型采用记忆驱动机制,为预测与决策设计,还展现了在多领域的预测能力,且将开放相关框架和模型。

机器之心
新闻资讯7

真热AI!米哈游5亿成立新公司

米哈游全资成立上海米哈游无定谷科技有限公司,注册资本5亿,经营范围涉及人工智能等领域。米哈游在AI领域布局已久,有研大模型,创始人蔡浩宇也有相关创业动作,旗下游戏还与马斯克的AI女友互动。

量子位
开源动态8

7B模型对标GPT-4o,全球首个医疗代码生成大模型训练平台来了

研究团队发布全球首个医疗代码生成大模型训练平台MedAgentGym,提供评估基准和训练生态,提升大模型医疗代码生成与推理能力。经其训练的Med - Copilot - 7B达GPT - 4o相当水平,解决医疗AI编程瓶颈。

量子位
新闻资讯7

哈萨比斯出的难题,GPT之父接上了:用一个知识停在1930年的模型

GPT之父Alec Radford等用1931年前数据训练13B模型Talkie,切断现代知识污染。研究者测试其能力,探讨它对未来的“预感”、规避污染问题及数据多样性等,同时训练中也面临时间泄漏、数据质量等难题。

机器之心
新闻资讯8

OpenAI重回巅峰:GPT‑5.5全球SOTA,碾压Opus 4.7

OpenAI发布GPT - 5.5,定位为‘为真实工作而生的新一代智能’。它在编码、科研、办公等多领域表现出色,能力重心转向‘主完成任务’,在多项评估中成绩优异,还能加速生物医学研究,且Token效率大幅提升。

AIGC开放社区