「信任策略」共找到 1032 篇相关文章
博士宿舍激情脑暴,革新了Scaling Law?Qwen和浙大联手推出新定律,直接干掉95.5%推理内存!
近日,阿里与浙大合作提出并行计算缩放定律 ParScale,可在不增参数下提升大模型能力,推理效率更高。它通过引入并行流实现,在数学、编程等任务表现佳,适合边缘设备,代码已开源。
AI大佬教你如何中顶会:写论文也要关注「叙事」
NeurIPS投稿截止不到一月,Google DeepMind的Neel Nanda发布机器学习论文撰写指南,旨在解决论文表达晦涩问题。指南涵盖理想论文精髓、写作关键要素、结构解析、流程建议及常见问题应对策略。
突破多模态奖励瓶颈!中科院清华快手联合提出R1-Reward,用强化学习赋予模型长期推理能力
多模态奖励模型(MRMs)对提升多模态大语言模型表现至关重要,强化学习理论上可引入长期推理能力,但现有RL算法用于训练MRM会不稳定。中科院、清华等团队推出R1 - Reward模型,在多模态奖励模型benchmark上有显著提升。
我是如何破解 NotebookLM 系统提示词的?
作者分享通过“逆向推理”破解NotebookLM系统提示词的故事,介绍系统提示词概念、破解原因、策略及从播客音频逆推提示词的方法,还提到该方法的效果及局限性 。
99分=0分!用《孙子兵法》《隆中对》做物理 AI,吴甘沙十年拿下全球机场 91% 份额
吴甘沙在演讲中分享驭势科技创业十年心得,用《孙子兵法》《隆中对》构建竞争策略,指出自动驾驶达99分易,最后1%难,是创业公司护城河。还介绍了市场选择、技术路线、商业模式等内容。
盘点16个把自己蒸馏成Skills的国民级App。
作者盘点16个将自身能力封装成Skill或MCP的国民级App,涉及餐饮、出行、办公等领域,如瑞幸咖啡、飞猪、飞书等,还提到部分AI产品集成第三方服务情况,指出向全面Agent化过渡的趋势。
全球排名前三,复旦自进化Harness Engineering让GPT‑5.4再涨7个点
2026 年以来,Harness Engineering 成业界热词。复旦大学等团队提出 Agentic Harness Engineering (AHE),可实现 Harness 自动优化。实验中,AHE 让 GPT - 5.4 分数提升,适配 GPT - 5.5 后排名全球第三,且有良好泛化能力。
Anthropic 发布 Computer Use 最佳实践
Anthropic发布Computer Use开发者最佳实践,涵盖截图处理、模型选择、上下文管理等多方面。如缩小截图提升点击准确率,不同模型各有所长,还给出应对小目标、提示注入等问题的策略及教学、顾问模式。
Transformer可以改装成Mamba了:苹果把推理成本直接打成线性
苹果将Transformer改造成Mamba,采用‘两步走’策略,先造中间形态,再转成Mamba,避免性能崩塌。实验显示,新方法性能几乎没掉,成本逻辑改变,为模型降本重构提供新可能。
GPT-5核心推手闪电跳槽,Anthropic CEO高调炫耀员工留存碾压OpenAI,“AI第一公司”光环崩塌?
OpenAI后训练负责人、GPT - 5核心推手Max Schwarzer跳槽至Anthropic,此前也有多位技术领袖离开。OpenAI在商业版图扩张与伦理争议并存下,正从参数军备赛转向体验护城河,同时加速商业与政治布局,但面临人才流失等问题。