「以模型为中心」共找到 8790 篇相关文章

推荐文章9

百度百舸演讲:用 Agent 优化 SGLang,从改Kernel修改到端到端验证

本文是百度百舸与SGLang联合Meetup的分享整理,讲解如何让Agent完成从瓶颈定位、Kernel修改到端到端验证的全流程SGLang性能优化,覆盖多类模型场景,公布实测性能提升数据与百度百舸的通信优化效果。

GiantPandaLLM
算法论文7

The Batch: 979 | LLM 清理智能体的“垃圾”

研究人员提出选择性管理智能体记忆之法,小红书Xubin Hao等构建Self - GC。它在送上下文给LLM前,让大语言模型决定内容取舍。测试显示其删历史少且保留必要细节能力强,不过未测其输出质量。

DeeplearningAI
新闻资讯8

OpenAI公布首颗自研推理芯片成绩,下一代已进入制造阶段

8月25日,OpenAI公布自研推理芯片Jalapeño性能测试结果,首次给出其在多款公开大模型上的具体数据。该芯片在低功耗下实现高推理吞吐量和低延迟,性能超英伟达芯片,B0版已进入制造阶段。

DeepTech深科技
开源动态8

AI能否独立开展科研?ASI-Bench为科学自主性建立评测标尺

ASI-Bench是衡量AI系统科学自主性的基准测试,由多机构联合开发。它能测试AI通用智能、创新性和执行力,通过信息梯度设计,让模型在不同指导量下完成科研任务,结果显示当前AI离自主科研有明显距离。

机器之心
新闻资讯7

英伟达和AMD,开始争夺AI制药的计算入口

每年的 Advancing AI 大会,AMD 都要回答 Instinct GPU 除训练大模型外的应用问题。今年大会上,AMD 把一个位置留给 AI 制药公司 MindWalk。而其对手英伟达已在生命科学领域布局多年,生命科学成两家竞争新战场。

DeepTech深科技
新闻资讯8

决战8月!Anthropic甩出Fable 5.1,奥特曼携GPT-6连夜汇报

GPT - 6和Fable 5.1很可能8月上线。奥特曼赴华盛顿汇报GPT - 6,它有原创科研等能力。Anthropic准备以Fable 5.1狙击,定价不变。GPT - 6有技术突破,但也有安全风险,8月对决将影响AI产业走向。

新智元
产品应用7

爆删80%系统提示词!Anthropic核心成员揭秘Claude 5最新玩法:上下文工程全面大换血

Anthropic针对Claude Opus 5、Claude Fable 5等新模型,删超80%Claude Code系统提示词,编码测试成绩无明显下降。CC技术团队成员发文指上下文工程规则重写,还总结新旧规则对比,并给出内容撰写建议,还上线新命令。

AI寒武纪
新闻资讯7

告别传统存算分离,AI时代数据底座迎来全新底层逻辑

文章围绕AI时代数据底座变革展开。指出传统大数据平台难适配AI,存在数据够不着、模型用不好等问题。阐述AI时代基础设施变化,如数据形态、计算模式等。还探讨底座升级条件、存储挑战、算子价值及未来标准层等内容。

AI前线
新闻资讯7

Token需求狂飙千倍,22亿热钱涌向这家AGI Infra头号玩家

在AI基础设施成风口的背景下,国内AGI Infra头部玩家无问芯穹获超7亿融资,其Token调用量爆发式增长。随着AI产业进入Agent阶段,传统架构难适配新需求,无问芯穹以中立定位成Token经济枢纽。

量子位
产品应用7

Anthropic 深夜发布 Claude Design,一句话生成 UI,百亿美元市值 Figma 股价跌了 4.6%

Anthropic 发布新产品 Claude Design,由 Claude Opus 4.7 支持,以研究预览形式向部分用户开放。它定位为设计师“搭子”,覆盖多设计工作流。网友评价高,但也有人指出其生成结果有同质化问题,对传统设计工具冲击待察。

InfoQ