安全推理」共找到 2897 篇相关文章

开源动态8

马斯克转发字节Seed&哥大商学院新基准:大模型搞金融,连查个股价都能出错

字节跳动Seed团队与哥大商学院推出开源金融搜索与推理基准测试FinSearchComp,含635个问题。评测显示大模型处理金融任务有差距,凸显金融AI能力评估重要性,还揭示了关键能力差距。

量子位
新闻资讯7

史上最大升级!7亿周活ChatGPT逼宫,谷歌慌了,这次要把AI整个塞进Chrome

Chrome迎来史上最大AI升级,谷歌将大模型Gemini全面接入,从内置AI助手到安全防护等多方面改写使用范式。谷歌急于部署,因ChatGPT周活达7亿,AI重塑上网体验,谷歌有危机感。

新智元
新闻资讯7

谁在重新定义 AI 云?

过去几年,AI成云计算行业统一叙事,但厂商口号趋同,差异化消解。当下AI从“炫技”走向“应用”,华为云在全联接大会2025上提出新组合,回应行业成本、基建和应用难题,不过路径也面临挑战。

AI科技评论
开源动态8

Github 1.8K star厉害!!有了这个办公AI神器,效率飙升!

Speakr是完全自托管的AI会议助手,能将音频转文字、生成摘要、进行内容问答,离线运行保障隐私和安全。它功能丰富且轻巧,支持多平台,GitHub已破1.8K star。

开源先锋
开源动态8

首个基于MCP 的 RAG 框架:UltraRAG 2.0用几十行代码实现高性能RAG, 拒绝冗长工程实现

检索增强生成系统(RAG)复杂度提升,工程实现成本高。清华大学等联合推出首个基于MCP架构的UltraRAG 2.0,组件化封装、调用扩展灵活,低代码实现高性能,可用于科研和行业应用。

AI前线
产品应用8

谷歌认领最强AI版Photoshop!现在人人可用,效果确实强悍

谷歌认领神秘图像编辑模型nano - banana,即Gemini 2.5 Flash Image。它可免费在Gemini和Google AI Studio使用,API收费。该模型图像编辑能力出色,能合并图片、实现2D到3D转换等,此前爆火却无官方文档。

量子位
7

刚刚,Anthropic推出Claude Chrome插件,仅限1000人

Anthropic发布Claude for Chrome扩展,让Claude能在浏览器操作,仅向1000名Max计划用户开放预览。虽功能强大,但面临提示注入攻击风险。不过Anthropic有多层防护,降低了攻击成功率,并给出用户安全建议。

AGI Hunt
算法论文8

ChatGPT到底学了多少「污言秽语」?清华团队首提大语言模型中文语料污染治理技术

清华等团队研究发现,先进ChatGPT系列模型中文词表污染达46.6%,含色情、赌博等词元。团队定义分类中文污染词,构建识别模型,还能由词表污染估计数据污染,为语料治理提供方案。

机器之心
算法论文8

冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世

微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理多余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化多响应属性,团队还提出自适应难度变体,实验显示 GFPO 在多方面表现出色。

机器之心
新闻资讯7

xAI联合创始人出走:连马斯克都留不住顶级人才

伊戈尔·巴布什金这位效力过DeepMind和OpenAI的AI老将,助马斯克建成孟菲斯超算集群后离开xAI,创办风投公司“Babuschkin Ventures”,瞄准AI安全赛道,揭示AI行业顶尖人才的追求。

AI工程化