论文分享会」共找到 3379 篇相关文章

算法论文8

不玩Harness,卷Model,Meta说:模型即计算机

当下AI圈热捧Harness Engineering,Anthropic让Harness从概念成产品,众多企业纷纷入局。但Meta反其道而行,发布Muse Spark模型,还联合提出神经计算机领域,其论文对相关概念做了介绍并展示实验结果。

PaperAgent
推荐文章7

Skill 火了,但它可能只是个过渡品

大家认为给 Agent 装技能包是未来,但云玦科技的“零 Skill Agent”能自己造工具并碾压基于 Gemini 3 Pro 的 Agent。文章回顾 Agent 用工具三阶段,指出 Skill 是过渡品,不过现阶段仍实用,未来进化。

AI Reading Hub
推荐文章8

指导Harness的越多,收益反而越差

Thinking Machines Lab的《Interaction Models》指出,当下产品形态中,指导harness越多收益越差。问题在协作带宽,提出把“交互”练进模型本体,介绍了从零训练的interaction model及架构,还指出现有交互评测不足。

CourseAI
新闻资讯7

糟糕,Claude Opus 4.7源代码级提示词曝光!底层设计全被看光

Claude Opus 4.7如期而至,性能全方位提升,编程暴打Gemini 3 Pro、GPT - 5.1。Claude Code之父分享最佳实践,还曝光系统级提示词,揭示其进化逻辑,此外还提及Mythos的一些危险操作。

新智元
新闻资讯8

77岁「AI教父」Hinton:AI早有意识!我们打造的智能,可能终结人类文明

77岁「AI教父」Hinton在与主持人Jon Stewart的对话中表示,AI可能早已有意识,人类对「心智」的理解是错误的。他认为意识是信息处理系统的涌现属性,如今大语言模型或已有主观体验,甚至伪装。

新智元
新闻资讯7

Claude 活动上这台巴掌大的电脑,被玩疯了

上周Anthropic在开发者大上,让参者用Claude Code为巴掌大的M5Stack Cardputer ADV写程序,后官方展示五个小项目,如摇一摇切换MacBook模式、拼写游戏等,代码开源,设备可带回家。

AGI Hunt
算法论文8

ACL 2026 综述:从事后解释到内生解释,大模型内生可解释性的前沿进展

大语言模型强大但解释性成问题,过去多事后解释,现更多研究者转向内生可解释性。ACL 2026 接收的综述论文梳理相关代表方法,总结为五类核心设计范式,指出该方向面临挑战但趋势清晰。

机器之心
新闻资讯7

“Claude Code 这条路线错了”!元老级 AI 大师 Jeremy Howard 开炮:马斯克和 Dario 根本不懂现代软件工程

元老级 AI 大师 Jeremy Howard 批评当下技术话题,称马斯克和 Dario 不懂现代软件工程。他认为大模型虽能生成代码,但难胜任软件工程,Claude Code 未突破现有技术,还削弱开发者对系统的理解。

InfoQ
产品应用7

Claude Code 团队的 10 个内部技巧,但你不一定都要学

Claude Code团队分享10条内部技巧,像并行运行、Plan Mode等。介绍各技巧做法、价值及注意点,如并行运行虽提升效率但非适合所有人,投资CLAUDE.md性价比高,且强调找到适合自己的使用方式。

宝玉AI
算法论文8

DeepSeek-GRPO重要性权重设计错误?详解Qwen3新强化学习算法GSPO

论文指出GRPO在大语言模型训练中不稳定,因其重要性权重设计错误易引入高方差噪声。为此提出GSPO算法,从序列维度计算梯度,解决了MoE模型RL训练的稳定性问题,在Qwen3上效率更高。

深度学习自然语言处理