「前缀和计算」共找到 7285 篇相关文章
Windsurf惊魂96小时!AI闪电并购战:谷歌天价挖人,Cognition逆袭接盘
7月,谷歌以翻倍薪资和24亿美金许可协议挖走Windsurf 40多位顶尖人才。周一,Cognition宣布收购其剩余资产和200来号员工。此前OpenAI收购谈崩,Windsurf还遇模型使用问题。
The Batch:826 | 提高输出准确性的记忆层
通常提高大语言模型事实准确性需更大模型规模,会增加计算成本。Meta研究人员在transformer架构加可训练记忆层,可高效存储提取信息,提升计算效率,测试显示其能提升模型输出质量。
后训练中的RL已死?MIT新算法挑战传统后训练思维,谢赛宁转发
MIT研究人员提出RandOpt新算法,挑战传统后训练思维。该算法通过随机扰动和集成突破限制,在多任务中表现出色,揭示了预训练模型权重空间的“神经丛林”现象,引发AI社区关注。
微软 & UT Dallas 联手揭秘:从 SFT 到 RL 的进阶之路
微软与 UT Dallas 合作论文揭秘大模型做漏洞检测从 SFT 到 RL 的后训练流程,构建 C/C++ 漏洞数据集跑通全流程,总结六大‘避坑’指南,还开源整套框架、数据集和模型。
2.8K Star!开源免费的离线OCR工具,识别准确率媲美大厂。
在文档数字化和自动化工作流中,离线OCR工具受青睐。GitHub上的TrWebOCR开源、离线,中文识别率高,媲美大厂。它亮点多,有快速上手指南和接口调用示例,适用场景广,但两年未更新。
谷歌太壕了!编程Agent大招至简:开源且免费,百万上下文、多模态、MCP全支持
谷歌开源免费的编程Agent Gemini CLI,提供业界最高免费限额,能在终端访问Gemini。其能力多样,涵盖代码理解等,支持百万上下文、多模态和MCP,开源协议为Apache 2.0,还给出安装和使用指引。
0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26
大视觉语言模型带来隐蔽攻击面,现有检测器难平衡。中国人民大学与阿里巴巴集团联合提出Learning to Detect(LoD),不依赖攻击样本和手工规则,从模型内部激活学安全模式,实验效果好且代码开源。
观猹 × MuSH | AI 练摊市集招募中,你的 AI 能让路人玩上 5 分钟吗?
5月15日上海举办MuShanghai AI Week,五天有不同主题活动。收官日有首个中外开发者齐聚的Demo练摊市集,强调产品好玩,设投票机制和奖项,还分闪电秀PK赛与开放麦环节。
【医学影像分割】UN-SAM:一种高效且通用的细胞核分割模型
文章提出UN - SAM框架解决现有SAM在医学影像分割依赖人工标注、跨域泛化不足问题。它含三大模块,能自动生成提示、增强特征判别力和跨域分割精度,实验显示其在多数据集表现优,代码已开源。
Claude Managed Agents提了两个新改进,解决企业级安全问题
企业把AI接入内网,认证令牌风险大,阻碍全面接入内部API和数据库。Anthropic为Claude Managed Agents提出自托管沙箱和MCP隧道两个新解法,核心是让凭证控制权留在网络边界,还介绍了相关沙箱服务商。