「训练评估体系」共找到 3217 篇相关文章
李飞飞LeCun疯狂加注!这匹中国黑马,已在因果AI暗战6年
世界模型成AI核心战场,背后是行业向因果科学转向。多数人2026年关注“因果”,中国零犀科技早在2020年就探索因果AI,自研因果大模型,搭建工程架构,将能力融入业务体系,提前布局优势凸显。
Claude Sonnet 5:更强,但更贵,每任务成本反超Opus 4.8
Anthropic 发布的 Claude Sonnet 5 智能指数追平 GPT - 5.5,但每任务成本比 Opus 4.8 贵 15%。它在知识工作类任务表现佳,推出促销价,不过促销后成本待察。评估迁移时需算 token 消耗。
单目3DGS迎来突破:影石开源UniSHARP实现全相机适配
影石研究院发布单目新视角合成模型UniSHARP,可通过单次推理秒级获场景高斯点云,支持混合相机训练与免标定推理,适配所有相机。团队还构建数据集、设benchmark,代码等均已开源。
3B小模型,编程得分比肩Opus 4.5,神秘模型引发热议,原是国产
最近,3B小模型VibeThinker - 3B在X上火了,它在编程等推理任务上比肩前沿大模型,体积却小很多。它是国产模型,来自新浪微博团队,在各项基准测试表现出色,不过在通用知识领域表现欠佳。
OpenClaw 类自主智能体生态构建
文章围绕OpenClaw类自主智能体生态展开,从生态视角、记忆系统、上下文管理等多方面阐述其构建,还分析了安全风险、治理体系、角色分工及面临的挑战与机会,为理解和发展Agent生态提供参考。
后OpenClaw时代!国产Agent模型凭「高配低价」叫板Opus 4.6
昆仑万维旗下天工AI发布SkyClaw - v1.0智能体模型及轻量化版SkyClaw - v1.0 - lite。该模型在底层能力提升,适配主流框架,跑分和实际应用表现出色,还具有低门槛、高性价比优势,限时免费体验。
Qwen3-VL-Seg 深度解读:当多模态大模型学会"像素级精准手术",仅用0.4%参数碾压8B模型
文章深度解读阿里通义实验室发布的Qwen3-VL-Seg,它解决开放世界指代分割问题,用仅17M参数(占基础模型0.4%)在4B规模超越8B模型。介绍其原理、架构、数据、实验结果,还给出实战代码。
英伟达为何持续押注VASTData?AI存储正在成为新的“算力”|甲子光年
AI产业曾聚焦GPU,如今数据存储设施重要性凸显。VAST Data完成约10亿美元F轮融资,估值300亿美元,英伟达持续跟投。它重构AI数据基础设施,国内焱融科技有相似技术路线且具自主可控优势。
何恺明首个语言模型:105M参数,不走GPT自回归老路
何恺明团队推出全新连续扩散语言模型ELF,不走GPT自回归老路。它将生成过程留在连续embedding空间,最后离散化变回token。ELF用较少参数、训练token和采样步数,跑赢主流扩散语言模型。
谷歌推出Googlebook:为Gemini重新造一台笔记本
谷歌宣布推出全新笔记本产品线Googlebook,专为Gemini AI打造。它融合Android和ChromeOS体系,有Magic Pointer等新功能,与Android手机协作顺畅,还新增Quick Access功能,首批设备由多厂商合作生产,今年秋季发布。