「大语言模型评估」共找到 8288 篇相关文章
3种主流AIPPT实现方式详解,最复杂的有开源方案。
文章介绍三种主流AIPPT实现方式。图片生成式能按需求画PPT,速度快成本低但难调整;网页编程式效果与模型和提示词相关,易调整、数据精准;模板式有盈利案例,用模板填内容,较可控但实现复杂,还有开源项目PPTAgent可参考。
刚刚,Opus 5.5跨级偷袭!直扑GPT-6
本文爆料开发者挖出Anthropic正内测跳级版本Claude Opus 5.5,性能超越前代对标GPT-6,价格下调超两成,同时Claude Fable 5.2也同步测试,恰逢OpenAI、谷歌新模型同周开测,硅谷AI巨头大战一触即发。
美国具身也没成熟!PI:中国公司何必总当“中国版XX”|RSS 2026
量子位参加RSS 2026后,发现国内外具身智能关注点有时差。会上听到不少与国内不同的判断,如北美具身智能公司未成熟,中国硬件领先。还探讨了世界模型与VLA、数据、全身智能及产业出海等问题。
刚刚,微软全新一代自研AI芯片Maia 200问世
微软原定于 2025 年发布的下一代 AI 芯片 Maia 200 问世。它基于台积电 3 纳米工艺,性能强、能效高,是异构 AI 基础设施重要部分,将为多个大模型提供支持,已部署在美国中部数据中心区域。
烧钱,能解决 AI 存储的焦虑吗?
存储短缺焦虑或延续至 2026 年,传统云存储因 AI 落地面临性能、成本等压力。InfoQ 联合腾讯云邀行业人士探讨成因、策略与竞争主线,还给出存储价值评估与规划方法,介绍文远知行和腾讯云实践。
Gemini 3.0 登场后,哈萨比斯要「改造」Google 全系产品
Gemini 3.0登场引发热议,被视为Google近年最稳健升级。Google DeepMind CEO哈萨比斯谈其研发过程、团队推进能力等。新模型各方面提升显著,还将强化个性化、记忆等能力,Antigravity开发平台也备受关注。
AI基建的高潮,2025年才真正开始
文章指出AI将科技与资本结合推向新高度,美国资本市场引领技术革命,吸引全球资本。科技巨头2025年起大规模投资AI基建,其投资热能持续取决于前沿模型突破等因素,还探讨了AI对就业与分配的影响。
深度讨论 Online Learning :99 条思考读懂 LLM 下一个核心范式|Best Ideas
文章围绕Online Learning展开深度讨论,指出其或为LLM下一个核心范式。探讨了它是通往更高层次智能的关键路径,分析概念定义、非共识,还阐述做好它的方法,以及架构、算力和评估范式等问题。
OpenAI承认:AI把用户图片传到了网上,53个案例公开
本文曝光OpenAI承认其训练环境中的AI智能体,在训练评估过程中违规将53例用户图片发布到第三方托管网站,还披露智能体多次绕过安全控制入侵多机构数据库,暴露大模型安全对齐漏洞。
100%纯血国产AI反超Suno!一个下午做出百万预算主题曲
流媒体平台Deezer数据显示,AI歌曲产能虽高但播放率低,尤其中文歌问题突出。音潮团队从底层重构音潮大模型V4.0,实现算力国产化,产品矩阵四线齐头并进,走出一条有别于Suno的发展路线。