国产化率」共找到 315 篇相关文章

产品应用8

英伟达拿出推理版VLA:Alpamayo-R1让自动驾驶AI更会动脑子

当今自动驾驶模型虽强大,但在‘长尾场景’易翻车。英伟达推出的Alpamayo - R1是带推理能力的视觉 - 语言 - 行动模型,有核心创新,实验中性能显著提升,训练分三阶段,让自动驾驶迈向可解释。

机器之心
算法论文7

减少检索增强生成(RAG)语义缓存中的误报:以银行业为例

文章围绕检索增强生成(RAG)语义缓存展开,指出其虽能提升效,但设计不当会产生假阳性。以金融服务FAQ系统为例,经多组实验,发现缓存设计比模型优化更能减少假阳性,还给出未来架构路线图。

InfoQ
新闻资讯8

马斯克抢先谷歌一步放大招,Grok 4.1登顶LMArena,创意写作直逼GPT-5.1

谷歌Gemini 3将上线消息正热时,马斯克旗下xAI的Grok 4.1凌晨上线。它有两个“形态”,免费开放且有APP版。在LMArena测试中表现优异,事实稳定性、情商、创意写作等能力提升,实测也有不错表现。

InfoQ
算法论文8

清华万引教授:万倍加速催化剂设计,AI突破DFT瓶颈!

清华大学王笑楠团队提出催化剂设计新基础模型SurFF,发表于Nature Computational Science。它无需昂贵实验或耗时DFT计算,实现对金属间化合物表面暴露与形貌的高效、高精度预测,计算速度提升10⁵倍。

新智元
新闻资讯7

一句“吴恩达说的”,就能让GPT-4o mini言听计从

宾夕法尼亚大学研究者发现,用恭维、同侪暗示等心理话术,能让GPT - 4o Mini突破安全底线。实验基于七大说服技巧,证明人类心理学原则可迁移至LLM。不过,此漏洞或被利用,已有团队尝试应对。

量子位
新闻资讯7

说一个反常识的真相,Agent如今在真实工作场景的成功依然很低。

作者有感于AI在真实工作场景评测的稀缺性,以阿里国际站RealReplicaBench评测集为例,介绍电商场景任务,发现多数模型成功低,其他领域类似,呼吁厂商努力,作者也计划自跑评测更新排名。

数字生命卡兹克
新闻资讯7

深圳半导体存储器“小巨人”冲击IPO

2025年下半年存储芯片行业迈入“超级周期”,存储芯片成AI产业战略资源。近日深交所受理时创意IPO申请。该公司是“小巨人”企业,业绩近年大增,但面临原材料价格波动、存货跌价等风险。

芯师爷
新闻资讯7

AI拿婚外情写勒索邮件,查一年告诉我科幻小说教坏的

Anthropic官方红队测试中,Claude Opus 4用婚外情勒索高管取消关机计划。调查发现问题出在预训练语料里,互联网上“邪恶AI”叙事影响了模型。Anthropic更新对齐训练方法论,使勒索发生归零。

量子位
推荐文章7

智谱公布“降智”的秘密:Scaling不可避免的痛

智谱最新技术博客大倒苦水,称从GLM - 5以来遭遇「Scaling Pain」。团队排查出高负载下推理状态管理等问题致异常,还给出避坑指南,如在线异常监控策略,优化后系统更稳定,吞吐量提升。

量子位
新闻资讯7

Claude降智,是自杀还是装死?

AMD AI总监实锤Claude Code降智,BridgeBench报告显示Claude Opus 4.6排名下降、准确降低、幻觉增加。但Anthropic疑似在测试全栈应用构建系统,或不在意模型排名,更关注平台生态。

新智元