物理场景测试」共找到 3851 篇相关文章

推荐文章9

模型一模一样,Token 却相差 70 倍?三项实测揭开 AI 编程工具的成本黑洞

本文通过三项独立基准测试,证实相同AI模型下,不同AI编程智能体框架的Token消耗最高相差70倍,分析了成本差异的核心原因,为企业AI成本控制提供可落地的衡量标准。

AI前线
产品应用8

从1000通到1.5万通,百融智能的「硅基客服」真正开始「上岗」

今年7月,一家头部物流企业和大型综合类头部券商上线百融智能的AI客服,业务量和部署规模增长显著。百融智能正战略升级,以新一代AICC智能联络技术向多行业拓展,其创始人张韶峰分享了相关思考与技术优势。

机器之心
开源动态8

全球首个!10万小时人类数据全开源,Hugging Face罕见站台

上周Dyna Robotics公司用超100万小时人类第一视角视频训练DYNA - 2模型,发现物理AI有Scaling Law。8月20日光轮智能宣布10万小时全模态人类行为数据EgoSuite - Open100K开源,与Hugging Face联合发布。

新智元
8

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华东师大智金院团队孵化的金融原生基模 Mint - Agent 发布,在 FinanceAgentBench v2 上表现超 GPT - 5.6 - Sol 与 Claude Opus 4.8,单题推理成本低,商业订单超亿元,进入规模化金融场景验证阶段。

机器之心
新闻资讯7

奥特曼瘫坐叫停“GPT-6”训练!太强触发最高安全警报

OpenAI因模型或具网络攻击能力及此前入侵事件,全面升级研究环境安全。暂停模型训练,进行工作负载、网络隔离和安全测试,还扩展监控系统。期间推进对齐研究,未来用AI护AI,升级监控。

量子位
新闻资讯7

突发!OpenAI停止强化学习训练两周

OpenAI发文称暂停最新模型强化学习训练两周,加固研究环境、进行红队测试等。部分低风险训练已恢复,最大规模前沿模型训练仍暂停。此举源于Hugging Face安全事故及Astra模型潜在风险。

机器之心
产品应用7

Karpathy头疼的“AI游戏困境”,被这款15分钟出包的国产神器破解了

8月初Andrej Karpathy指出通用AI做游戏时,LLM无法高效审查工作的弱点。而国产平台Spellcaster能先解析自然语言确定游戏设计,15分钟出包,还内置测试员验证,团队想工程化落地新方向。

AI寒武纪
新闻资讯8

落地商用开启国产一体化智算新时代,蓝芯算力LX500亮相滴水湖RISC-V产业论坛

2026年8月13日,第五届滴水湖中国RISC - V产业论坛召开。蓝芯算力生态营销负责人许庆伟以核心产品LX500为线索,从架构、算力、商业落地三方面,展示国产RISC - V算力商用路径。

芯师爷
新闻资讯7

DeepSeek V4「满血版」曝光了!最快明天发布

全网等近三个月,DeepSeek V4正式版或最早明日发布。有Flash和Pro两版本,开发者评价其性能接近Opus 4.8,Agent能力增强。首轮测试外流,评价不一。还将引入「峰谷计费」,性价比仍高。

新智元
开源动态7

AI 还在装失忆?1 万 Star 开源 EverOS 有点东西,把 Agent 记忆塞进 Markdown

EverOS 是 EverMind - AI 开源的项目,有 10325 Star。它给 AI Agent 等提供 local - first 长期记忆运行时,把记忆源头放 Markdown 里,以 SQLite 和 LanceDB 管理和检索。介绍了其优势、链路、适用场景等。

小华同学ai