「大模型安全」共找到 9781 篇相关文章

产品应用8

jina-reranker-v3刷新全球重排榜,效率狂飙4.79%

jina-reranker-v3作为LLM时代向量模型,提出“最后但不晚”交互机制,解决文档检索效率与效果权衡、多语言文档重排性能与效率平衡、模型泛化能力和适应性等问题,架构与训练方案有创新。

CourseAI
新闻资讯8

刚刚,OpenAI发布白皮书:如何在AI时代保持领先

AI发展超多数企业适应能力,早期采用者收入增长更快。9月3日OpenAI发布白皮书,总结与大企业合作经验,给出从战略到治理的五大核心原则及多方面重点建议,助企业在AI时代保持领先。

机器之心
新闻资讯7

AI系统10分钟生成CVE漏洞利用程序:网络安全攻防战进入“分钟时代”

研究人员开发的AI系统能10 - 15分钟生成CVE漏洞利用程序,成本约1美元,准确性和可靠性高。此外,HPTSA系统可利用零日漏洞。传统网络安全防御模式失效,攻防失衡加剧,AI攻防对抗趋势明显,有专业化、自主化、高强度特点。

AIGC开放社区
推荐文章8

为什么Claude Code 如此好?「以及如何在自己工作流中复刻Claude Code体验」

本文分析Claude Code好用的原因及如何复刻其体验。作者抓包分析其请求后给出要点,如可调试性优先、保持单一循环、LLM搜索优于RAG等,还阐述控制循环、提示词、工具等设计方法。

AI寒武纪
新闻资讯7

网友晒 21 页 PDF 质疑 Grok 3 套壳 Claude,Grok 3 自己承认了!xAI 工程师被喷无能

网友 GpsTracker 爆料,埃隆·马斯克旗下 xAI 公司的 Grok 3 模型在“思考模式”下自称是竞争对手 Anthropic 公司的 Claude 3.5。网友提供对话记录和 21 页 PDF 佐证,引发社区对模型异常原因的讨论。

InfoQ
算法论文7

UniSteer用机械臂「拼豆」:让人类指导进入VLA噪声空间强化学习

视觉 - 语言 - 动作模型(VLA)是机器人操作重要基础模型,但复杂任务成功率低,真机强化学习成本高。微软等机构研究者提出 UniSteer,将人类纠正转换成噪声监督,在多任务测试中提升了成功率。

机器之心
产品应用7

AI写代码终于不瞎烧钱了:边车路由让顶级性能成本直降35%

传统模型路由用于写生产代码易掉链子,Cognition发布的Devin Fusion混合模型框架可解决该问题。官方测试显示,它能降35%编码智能成本且质量无明显下滑,从实际测试案例可看出其适用边界。

AI工程化
产品应用8

谷歌深夜双发!最便宜Nano Banana来了

谷歌深夜上线Nano Banana 2 Lite和Gemini Omni Flash。前者是最快最便宜文生图模型,4秒生图且成本低;后者是视频生成模型,支持多模态输入和对话式编辑。二者串联打通创作流水线,还集成SynthID水印技术。

新智元
新闻资讯8

人类已成少数派!DeepMind 研究科学家:广告没人看了,互联网上AI的流量已经超过了真人

Google DeepMind高级研究科学家Nenad Tomašev预测,未来世界主要网民将是智能体。他指出智能体虽能自动化工作,但存在安全风险,如认知单一化、网络陷阱等,还探讨了协作模式、安全防护及未来形态。

AI科技大本营
开源动态7

刚刚,阿里Qwen3.6又悄悄放出4个开源权重,卷疯了

继今年2月发布Qwen3.5系列后,阿里推出Qwen3.6多个开源权重版本。Qwen3.6优先保障稳定性与真实场景可用性,为开发者提供更好编码体验。介绍了Qwen3.6 - 27B和Qwen3.6 - 35B - A3B亮点。

PaperAgent