增智方法」共找到 447 篇相关文章

算法论文8

精准调控大模型生成与推理!浙大&腾讯新尝试为其注入“行为定向剂”

ACL 2025中选论文里,浙大与腾讯联合团队提出STA,深入模型内部分析神经元激活模式,干预关键神经元,抑制有害行为、保留通用性能,还在多模型实验验证效果,并将部分开源。

量子位
7

首届国产机器人足球赛,最忙的是担架

国内首个机器人主体足球赛在北京举行,四支高校战队用加速进化T1平台参赛,全程机器人自主行动。清华火神队夺冠,不过比赛中机器人失误多。主办预计5年提升其水平,赛事目标是2050年机器人队夺世界杯。

量子位
算法论文7

手机上实现AI视频实时生成,DiT模型上移动端

扩散变换器在视频生成任务性能强,但计算成本高,在手机上难实用。Snap提出创新优化,加速视频生成,能在iPhone 16 Pro Max上每秒超10帧,不过也存在细节退化等局限。

带你学AI
7

软件行业“快时尚化”背后的经济学 | AGIX PM Notes

本周市场对软件看悲观,OpenAI CEO 警告软件或进入‘快时尚时代’。但软件行业会升维,一是从‘死’变‘活’,具备元学习能力;二是定价更极致。还介绍了本周市场总结及多起 AI 相关企业动态。

海外独角兽
开源动态8

开源Agent模型榜第一名,现在是阿里通义DeepResearch

阿里开源首个深度研究Agent模型通义DeepResearch,在多权威评测集上超越多个Agent模型。它采用多阶段数据策略,有两种推理模式,革新训练流程,已赋能高德出行Agent和通义睿等应用,且模型等均已开源。

量子位
产品应用8

顶级邪修倾囊相授!藏师傅教你速通Nano Banana

作者歸藏教大家发掘图片编辑模型Nano Banana潜力。它上线后可白嫖,让Adobe等修图软件失色。介绍使用、多种修图玩及在电商、动漫修复等场景应用,称相关生意都值得用它重做。

歸藏的AI工具箱
算法论文8

吴恩达新作:87%推理token用不着,丢掉反而快3倍

吴恩达新作Prefix Sliding指出,模型推理时丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该为Agent场景提供新思路。

PaperAgent
算法论文8

NovaSilicon发表新论文:造芯的瓶颈不在工具,而在组织

NovaSilicon发表论文探讨超级智能在芯片领域的运用。随着芯片复杂度提升,传统EDA遇瓶颈,论文提出将芯片设计超级智能建模为AI组织,利用LLM等技术,重塑芯片设计行业,实现产业链智能化升级。

五源资本 5Y Capital
算法论文8

32B逆袭GPT-5.2:首个端到端GPU编程智能体框架StitchCUDA问世

现有LLM自动化CUDA难处理端到端GPU程序,StitchCUDA提出多智能体框架+基于Rubric Reward的Agentic RL案,分解任务、优化训练,在实验中成功率和加速比远超其他,解决Reward Hacking问题。

机器之心
新闻资讯7

打脸哲学无用!牛津博士教出Claude,自曝百万年薪提示词秘诀

Anthropic驻场哲学家Amanda Askell主导设计Claude的性格等机制,她分享制定有效AI提示词,认为需哲学思维。此外还提及不同人对提示词看,以及大模型存在的「裂脑问题」。

新智元