「推理服务基础设施」共找到 2930 篇相关文章
谷歌Chrome觉醒!Gemini 3全面接管,38亿用户一夜进入Agent时代
谷歌官宣所有桌面端Chrome浏览器接入Gemini 3,38亿用户的浏览器进化为全能AGI入口。此次更新改变人机交互方式,Chrome具备多种智能功能,如自动浏览、调用全家桶服务等,开启AI驱动的浏览时代。
英伟达Vera Rubin首秀,DeepSeek V4 Pro 跑出30倍Agent吞吐
NVIDIA公布基于真实芯片的Vera Rubin性能测试结果,在针对Agent工作负载的测试中优势明显。SpaceXAI将部署其CPU,探索轨道计算。这显示未来AI竞争关键是支撑Agent的计算基础设施。
Anthropic 新研究:AI出错是“热混乱”
Anthropic研究团队发现AI可能无一致目标,只是瞎搞。他们将AI错误分类,测试发现推理越久越混乱,大模型复杂任务易失控。此发现改变对AI风险的认知,论文已在arXiv发布。
大语言模型逻辑评估
现有归因问答评估方法有‘归因短视’问题,研究团队提出 LOGICSCORE 框架,从三维度量化推理质量。在多数据集测试多款 LLM,发现专有、开源模型等存在不同逻辑问题,还分析典型逻辑错误。
刚刚,字节开源Seed-OSS-36B模型,512k上下文
深夜,字节跳动Seed团队开源Seed-OSS系列模型,含三个版本。其用12万亿tokens训练,在多基准测试表现出色。有灵活推理预算控制等特性,原生支持512K上下文窗口,基准测试成绩佳。
ChatGPT血洗美国50万科技岗位!25年美国GDP增长,不靠人类靠AI?
文章指出,美国在AI基础设施上的支出快超人类劳动者,2025年因AI约30万到50万岗位流失,AI对GDP增长的贡献超消费者支出,应届毕业生就业市场惨淡,如CS专业高材生求职艰难。
刚刚,DeepSeek全新多模态技术开源!
DeepSeek联合北大、清华开源多模态技术及论文,提出“视觉基元推理”框架,解决MLLM指代鸿沟问题。基于DeepSeek - V4 - Flash构建的模型,性能比肩GPT - 5.4等。论文还介绍架构、训练流程等。
从被吐槽“套壳中国大模型”到自研封神!首次揭秘Cursor背后极速代码Agent如何对标GPT5.1 Codex,生成效率提4倍
10月29日,Cursor 2.0发布Composer大模型,效率约为其他模型四倍。开发者分享其成极速代码Agent方法,如强化学习、平衡训练与推理负载等,还提及未来方向及研发反思。
刚刚,DeepSeek官宣V3.1发布,Agent 能力较大提升
DeepSeek官宣V3.1发布,核心特性有混合推理架构、思考效率提升、Agent能力增强。产品形态含官方App/网页端和API升级。性能在编程、搜索智能体及思考效率上显著提升。
用开源中转统一接入Claude/OpenAI/Gemini:Sub2API核心功能解析
若同时用Claude、OpenAI、Gemini等,会面临账号分散、API Key管理难等问题。Sub2API是开源一站式中转服务,能统一接入这些订阅,还具备多账号管理、精确计费等功能,有多种部署方式。