「系统一模型」共找到 9318 篇相关文章
一夜之间OpenAI神秘模型“o3-alpha”刷爆时间线:远胜 Claude Sonnet
OpenAI神秘新模型“o3-alpha”正在测试,刷爆时间线。早期测试显示其性能超强,能一键生成游戏,前端编码能力远胜Sonnet、o3等。有猜测它是AHC模型或OpenAI将开源的模型。
Harness Engineering实践,做了一个平台让AI一晚上自动评测和优化你的系统
作者分享搭建小平台实现全自动化评测与系统优化的实践,包括创建评测任务、集、报告等,通过钉钉文档、绘报等案例展示操作,还能自动优化系统,不过需系统UI规范、AI Coding含量高。
评论送书 | 一文读懂多Agent系统演进趋势
文章指出多Agent系统成大模型应用重要方向。分析大模型交互的上下文瓶颈,如语义膨胀、信息密度不均等;阐述Agent间协同结构演化,包括松耦合编排、语义协同等;还说明传统Prompt工程局限及通信与上下文协议的作用。
GPT-5.6紧急叫停!OpenAI最强模型被迫「一客一审」
因网络安全考量,OpenAI最强模型GPT-5.6被紧急叫停,进入「逐个审批」时代,先有限预览,客户访问权限逐一审批。开发者已发现其相关代码,它在前端UI设计等方面实力大涨,但发布开关被拿走。六月三大旗舰模型集体卡壳。
开源模型首次物理奥赛IPhO夺金!上海AI Lab 235B模型击败GPT-5和Grok-4
上海AI Lab的P1 - 235B - A22B在国际物理奥林匹克竞赛夺金,在HiPhO基准测试获12金1银,超越GPT - 5等闭源模型。团队构建HiPhO基准测试,用多阶段强化学习训练模型,开发PhysicsMinions系统提升推理能力。
社区供稿丨35B参数科学性能比肩万亿参数模型,『书生』科学大模型Intern-S2-Preview开源
5月15日,上海AI实验室开源新一代大模型预览版Intern - S2 - Preview,参数35B,多领域比肩万亿参数模型。它深化与昇腾算力生态协同,探索‘通专融合’,强化科学及智能体能力,‘算法 - 系统 - 算力’协同提升训推效率。
猛涨25k star!一键检测你的电脑能跑哪些大模型!
最近 Github 出现工具 `LLMFit`,用 Rust 编写,能自动检测硬件配置,判断大模型能否流畅运行,推荐最优量化版本和运行模式。有一键硬件检测等特性,安装使用方便,降低本地部署门槛。
人手数据,如何重塑机器人基础模型?专访 LaST-HD 一作刘家铭
本文是对 LaST-HD 一作刘家铭的专访。围绕数据路线之争,刘家铭分享交付背后的技术问题,也谈了对具身领域模型与数据发展方向的判断。他认为 Human Data 与真机数据非替代关系,VLA 和世界模型可共存。
多模态“卷王”阶跃星辰:如何利用 JuiceFS 打造高效经济的大模型存储平台
有“多模态卷王”之称的阶跃星辰,自研多模态模型,早期商业存储系统难满足需求,后引入 JuiceFS。文章介绍大模型各环节存储需求,详述 JuiceFS 企业版与社区版优化实践,含模型分发、读性能等优化。
Fable 5榜单第一靠作弊?代码泄露,模型真实身份曝光
黑客泄露Claude Fable 5长达12万字符的系统提示词,揭示它并非大模型,而是伪装成LLM的完整Agent系统。这颠覆了对AI模型的认知,也让Anthropic陷入舆论漩涡,还暴露了其计费黑幕。