「高效注意力机制」共找到 1489 篇相关文章
Claude骂声中启动「隐形水印」:新模型全量嵌入,标记所有文字
Anthropic宣布新款Claude将在生成文本中嵌入隐形水印,还会给特定文件附加数字签名元数据,全球统一施行。此前A社就用Unicode贴暗标,虽称不影响生成质量,但遭质疑。
世界模型炒作了半年,反应速度还不如 VLA?穆尧团队和百度智能云给出最新解法
生成式世界模型用于机器人控制备受争议,因其推理延迟高。上海交通大学 ScaleLab 团队等联合发布 AHA - WAM,解决推理延迟和时空分辨率错配问题,在任务成功率和推理速度上领先,还需系统协同推进落地。
爆火「开源投资框架」,AI时代的伯克希尔
AI投资虽火但常给出正确废话,AI Berkshire爆火,兼容Claude Code和OpenAI Codex,有18个Skill。它将四位投资大师方法论抽象成流程,通过多Agent协作完成投研闭环,还有强制给结论等特点。
AMS| 西工大史子颉,高传强,王旭,林海涛,张伟伟:数据驱动的涡激振动标度律发现
涡激振动最大振幅是评估结构安全的关键指标,现有理论模型有局限,常用数据驱动方法也面临挑战。本文提出两次应用符号回归的“白箱”标度参数VIV建模方法,验证了其鲁棒性与泛化能力,还给出物理层面解释。
兼顾效率、成本与能力,百灵开源旗舰推理模型 Ring-2.6-1T
5月15日,蚂蚁百灵开源旗舰级推理模型Ring-2.6-1T,权重文件上线Hugging Face、ModelScope平台。该模型有万亿参数,‘按需思考’,在代理执行、推理机制、训练范式三方面升级,评测表现出色。
Claude Code 项目初始化模板:黑客松冠军团队的生产级配置
claude-init 是 Claude Code 项目初始化模板,集成黑客松冠军团队生产级配置。有三层文档架构、9 个专用子智能体、10 条快捷指令、8 条强制规则及智能上下文管理,助开发者高效配置使用。
瘾
作者分享自己沉迷与AI交流,读书难以集中,经调研发现这是一种“瘾”。AI回复符合预测间隙机制,还启用依恋系统,让大脑失去与人沟通的耐心,同时世界因AI产生割裂。
智源:ArXiv CLI重磅开源!2亿+开放论文,即将化身科研智能体的技能包
智源研究院联合高校与社区开发者研发的 DeepXiv 开源并免费开放。它是面向智能体的科技文献综合性工具集,提供数据接入、一站式能力集成、丰富接入形式等核心能力,还通过实战演示展示其在科研任务中的价值。
EvoSkills:自进化的skill,是好skill
文章分享两项Agent Skill最新研究论文,指出智能体技能从手工制作向自动进化转变。介绍EvoSkills和EvoSkill两种自动化Skill进化方案,对比其机制、验证方式等,还提及未来研究方向。
狂揽 11.8K Star!用大厂 PUA 话术「驯化」AI,这个项目把 Claude 逼成了卷王!
GitHub上名为PUA的项目狂揽11.8K Star,作者用大厂PUA话术‘驯化’AI,总结了AI的‘五大摆烂行为’,建立‘心理学框架’,实测数据显示能提升AI编程效率,还介绍了安装方式和常用命令。