「AI安全测试」共找到 11044 篇相关文章

产品应用8

30秒,我用蚂蚁灵光复刻了个支付宝(doge)

蚂蚁集团推出全模态通用AI助手灵光,最快30秒生成私人定制小APP,可编辑交互分享。实测其功能丰富且专业,实现多模态输出和多智能体协作。还对比了与千问区别,介绍蚂蚁AGI布局。

量子位
新闻资讯7

从“卡脖子”到“破局点”:一家中国公司的高端半导体键合突围战

芯师爷专访迈姆思半导体负责人潘总,该公司专注高端半导体材料“再制造”,技术体系有高端SOI制造、异质集成、混合键合三大支柱。其在多领域有领先产品,技术壁垒高,产能将逐步扩大,供应链安全可控。

芯师爷
开源动态8

推理速度10倍提升,蚂蚁集团开源业内首个高性能扩散语言模型推理框架dInfer

近日,蚂蚁集团开源业界首个高性能扩散语言模型推理框架 dInfer,在基准测试中,其将 dLLM 推理速度较 Fast - dLLM 提升 10 倍以上,攻克推理瓶颈,为开发者提供高效框架,推动扩散语言模型走向成熟。

机器之心
算法论文8

700万参数击败DeepSeek R1等,三星一人独作爆火,用递归颠覆大模型推理

今年6月Sapient Intelligence提出的HRM影响大模型推理结构,四个月后三星研究员Alexia Jolicoeur - Martineau推出TRM,700万参数模型在推理基准测试中超越参数多10000倍的模型,还介绍了TRM原理、改进及实验结果。

机器之心
新闻资讯7

Claude不让我们用!国产平替能顶上吗?

全球AI代码生成竞争格局生变,Anthropic地位动摇,一是OpenAI GPT - 5崛起,二是自身迷之操作。此时国产大模型发力,如Kimi - K2 - 0905、Qwen3 - Max - Preview,性能和价格有优势,有望改变竞争格局。

机器之心
算法论文8

综述 | Agentic RL for LLM的最新进展与未来挑战,idea满满

该综述对新兴的Agentic RL进行系统性总结与展望,介绍其与传统LLM - RL区别,从核心能力和任务视角阐述其应用,梳理支撑系统,指出核心挑战与未来方向,展示通向通用AI的希望之路。

深度学习自然语言处理
开源动态8

荣登HuggingFace周榜首位, 人大高瓴与快手提出ARPO实现智能体高效训练!

人大高瓴与快手提出的ARPO项目受高度关注,荣登Huggingface Paper日榜、周榜双首位。它是为多轮交互型LLM智能体设计的强化学习算法,在基准测试中,用一半工具调用预算就显著优于现有方法。

PaperAgent
新闻资讯7

实测GPT-5:写作坠入谷底,编程一骑绝尘。

文章记录了GPT - 5的发布情况,介绍其系统构成、减少事实幻觉和谄媚行为等改进,也提到跑分、性格设置等。实测发现写作和情商不如GPT - 4.5,但编程能力强,还感慨AI发展之快。

数字生命卡兹克
新闻资讯7

AlphaGo开发者创业挑战DeepSeek,成立仅一年目标融资10亿美元

前谷歌DeepMind成员、AlphaGo开发者创立Reflection AI,要开发开源大模型挑战DeepSeek,目标融资10亿美元。其已发布智能体Asimov,较其他模型更受用户偏好,还能捕捉隐性信息,已获少量企业收入。

量子位
推荐文章7

人生周报v035:我和你

本周人生周报分享了即刻、X平台上对AI时代产品与服务、人性、社区氛围等观点,推荐《我和你》,还输出对生活、思考、创作等方面感悟,如把一天当一生过、当答案免费问题无价等。

李继刚