安全训练」共找到 2979 篇相关文章

算法论文8

LLM进入「拖拽时代」!只靠Prompt,几秒定制一个大模型,效率飙升12000倍

新智元报道,NUS、UT Austin等机构研究人员提出「拖拽式大语言模型」(DnD),它基于提示词生成模型参数,无需微调适应任务,效率最高提升12000倍,零样本泛化能力出色。

新智元
产品应用7

我用了一个月Dia浏览器,已经彻底抛弃了Chrome!

作者黄叔结合创始人Josh Miller复盘文,介绍Dia浏览器使用技巧,如信息检索、内容创作等,还对比Arc,指出Dia核心是Chat和Personalization,设计理念优,更适合大众,建议大家使用。

AI产品黄叔
算法论文8

腾讯混元TurboS技术报告首次全公开:560B参数混合Mamba架构,自适应长短链融合

腾讯公开混元TurboS技术报告,该模型是超大型Hybrid Transformer - Mamba架构MoE模型,融合Mamba与Transformer架构优势,有自适应长短思维链机制,激活参数56B。在多评测中表现佳,推理成本低。

AI前线
推荐文章8

北大校友,OpenAI前安全副总裁Lilian Weng最新万字博客文章:Why We Think

北大校友Lilian Weng新发布万字博文《Why We Think》,系统梳理让AI模型‘多想一会儿’的前沿方法及逻辑,深入剖析多种机制突破AI性能瓶颈的理论、技术与进展,还提出一系列待解决的开放性问题。

AI寒武纪
产品应用7

美国州政府生成式AI应用报告

今年2月,美国阿拉巴马州州长签署行政命令推动生成式AI在州政府大面积应用,并发布深度应用报告。报告涵盖应用现状、伦理风险与策略、数据管理、政策治理等方面,为生成式AI在政府应用提供指引。

AIGC开放社区
开源动态8

DeepSeek-R1发布后的100天复现之旅方法总结

DeepSeek团队发布「推理大模型」DeepSeek-R1 ,其技术细节未完全开源,全球研究团队开启“复现竞赛”。论文总结100天复现经验,介绍推理大模型与普通大模型区别、复现方法、关键发现及未来方向。

深度学习自然语言处理
开源动态8

本地运行、支持视觉与工具调用:Meta 开源智能体模型

Meta AI Research 推出 300 亿参数的开放权重模型 Muse Glimmer,采用 Apache 2.0 许可证。它专为本地工作流设计,能在消费级硬件运行,经多项优化,在基准评估中表现出色,还支持多种框架。

AI前线
新闻资讯7

InfoQ 2026 年趋势报告:AI 重写工程师角色,但一切仍然关乎人

InfoQ 2026 年趋势报告探讨了 AI 对软件开发的影响,包括重写工程师角色、团队演变等。嘉宾指出 AI 采用应结合风险和业务场景,巩固基础,重新设计审查流程,关注质量和人的因素。

InfoQ
开源动态7

别怀疑,就是这么强!!!13.7k Star Casdoor,爽爽爽爽爽~~~~

Casdoor是可自己部署的IAM/SSO服务端,像“身份门”,一次认证后将多种身份管理功能集成。它协议覆盖广、能衔接认证与权限管理等。但使用时也得认真治理,避免越权问题。

小华同学ai
算法论文8

西交大提出QQWorld:仅需10行代码,世界模型成功率提升5.33个百分点

2026 年 3 月 Yann LeCun 等人提出 LeWorldModel,西安交通大学研究团队发现其存在问题,进而提出 QQWorld,用分位数—分位数匹配替换原有的 EP 正则,提升了规划成功率,还提出 Cross - Batch QQ 解决显存问题。

机器之心