「大模型安全评测」共找到 8503 篇相关文章
本周 5 个实用的 Github 开源项目,真香!
文章介绍本周5个实用Github开源项目。有资源聚合媒体中心stremio-web,AI原生安全测试平台CyberStrikeAI,本地优先AI编程远控工具hapi,智能股票分析系统daily_stock_analysis,纯前端JavaScript GUI智能体框架PageAgent。
Harness 工程就是控制论
文章指出OpenAI的Harness工程模式与瓦特离心式调速器、Kubernetes类似,都遵循控制论。代码库此前反馈回路在低层面,大语言模型改变现状,但需校准传感器和执行器,忽视工程实践代价会变得无法承受。
别再嫌弃MySQL了!AI时代,当DuckDB拥抱MySQL
本文围绕MySQL DuckDB引擎展开,介绍其产品形态演进,如推出只读与主实例。阐述主实例在Binlog适配、高可用与数据安全、数据入库、兼容性等方面能力,还分享出行平台实践,提及未来数据湖集成方向。
硅谷AI战火烧进医院!终于可以告别「天书」化验单了
OpenAI和Anthropic的战火燃至医疗领域,OpenAI发布ChatGPT健康,Anthropic推出医疗健康版Claude,还打通数据壁垒,提供个性化健康解答。其还在提升模型能力,保障隐私安全,且各有应用场景。
微软的prompt压缩方案-LLMLingua,开源
使用大语言模型时,提示信息长会致运行慢、费用高、易超限。微软推出的LLMLingua可压缩提示信息,有完整开源。它历经多版本演进,还能用于安全防御,使用简单,值得开发者跟踪。
已近2000亿美元注入,彭博社盘点2026年值得关注的24家AI初创公司
截至今年10月初,近2000亿美元注入人工智能初创企业。彭博社盘点2026年值得关注的24家AI初创公司,涉及模型开发、代码创作、实体智能等领域,还展现了AI产业思想分野。
刚刚,AI视频的天花板被掀翻!测完SkyReels后飘了:我亦有成为专业导演的潜质
昆仑万维官宣上线全新一站式多模态AI视频创作平台SkyReels,同步发布模型SkyReels V3并优化多能力。实测其画布、Agent等功能玩法多,还打通多模态边界,将巩固昆仑万维地位,加速人人专业创作愿景到来。
Bug变奖励:AI的小失误,揭开创造力真相!
最新研究发现,AI的「创造力」并非额外能力,而是架构副作用。扩散模型本应是复制机器,却画出奇怪图像。研究者基于规则构建数学系统,证明了这一观点,还推测人类灵感或许同理。
OpenAI Sora 2 登场!同步推出APP,Altman称这是创意领域的「ChatGPT 时刻」
OpenAI官宣新一代AI视频模型Sora 2,在物理准确性、逼真度等方面刷新SOTA,实现「音画同步」。Altman称其为创意领域的「ChatGPT时刻」。还推出Sora App,有新玩法,且在安全治理上布下「安全网」。
OpenAI编程新王GPT-5-Codex发布,7 小时搞定复杂代码,准确率飙升
OpenAI发布编程系统GPT - 5 - Codex,它是GPT - 5针对Codex产品的升级。能独立处理复杂编程任务,在性能、代码审查、前端开发等方面表现出色,还有严密安全体系,驱动Codex产品生态升级。