「测试时强化学习」共找到 2997 篇相关文章
国产物理AI黑马杀出!超越GPT与斯坦福Biomni,狂揽生物制造SOTA
恩和科技发布全球首个面向生物制造的物理人工智能平台 SAION AI,打破大模型只能虚拟辅助的刻板印象。它有认知、控制与闭环执行三层架构,在多项测试中表现领先,具备多方面核心优势,推动生物制造进入智能工程时代。
ChatGPT开测广告!OpenAI终于向“钱”看
OpenAI宣布在美国免费版及Go版测试ChatGPT广告功能,称是为支撑免费用户使用。广告不影响回答内容,会注明“赞助内容”。此外,新发布的GPT - 5.3 - Codex广受好评,还将推新聊天模型,其融资计划也在升温。
AI改造激光焊接检测!“过杀”率暴降50%,国际头部客户产线已用上
在第三届国际供应链博览会上,广州德擎光学科技的激光焊接在线检测系统展示了AI+先进制造检测落地效果。基于深度学习的AI检测模型,使焊接检测“过杀”率降50%,产线检测精度和效率提升,已用于国际头部客户产线。
Claude Sonnet 5 上线一日差评刷屏:打不过千问和 Minimax,性价比全面翻车
Claude Sonnet 5发布一天差评多。虽官方定位高,有能力亮点,但在中文测评中性价比低,测试成本高,且Max推理模式易过度思考。还因过度保守失去实用价值,其表现取决于使用场景和预算。
GPT-5.2技术炸场!6大核心突破,办公效率拉满
OpenAI凌晨发布GPT-5.2,把专业级AI门槛拉到新高度。它有6大核心技术突破,精准戳中职场痛点。在GDPval基准测试中表现出色,有三级模型矩阵,不同版本满足不同需求,各方面能力均有显著提升。
Vercel CEO爆Kimi K2智能体准确率超GPT-5 50%?国产的风还是吹到了硅谷
Vercel CEO称内部测试中,国产Kimi K2模型运行速度和准确率均优于GPT - 5和Claude Sonnet 4.5。硅谷多家公司已接入或转用K2,K2 Agent能力也经受住检验,还给出使用和价格相关信息。
管你模型多大,250份有毒文档统统放倒,Anthropic:LLM比想象中脆弱
Anthropic等联合研究打破传统观念,只需250份恶意文档就能在参数规模从6亿到130亿的LLM中植入后门,且与模型规模及训练数据量无关。研究还测试了特定后门攻击,评估了多种训练配置。
OpenAI「GPT门」事件引爆!Plus、Pro账户统统降配,偷换模型全网实锤
OpenAI被曝在用户不知情下,将GPT-4、GPT-5等模型路由至低算力敏感模型,引发用户对选择权和付费权益质疑。该现象已在社交媒体广泛验证,OpenAI回应称是在测试新安全路由系统。
高通Nuvia架构介绍
本文详细介绍高通Nuvia架构。Nuvia由经验丰富芯片设计师创立,后被高通收购,旨在强化自研技术、拓展市场。Oryon CPU架构是其成果,虽面临法律争议,但设计独特,多方面表现出色,还具备安全功能和较高性能。
GLM-5架构曝光,智谱两日涨60%:采用DeepSeek同款稀疏注意力
GitHub代码确认GLM - 5架构细节,它采用DeepSeek - V3/V3.2架构,含稀疏注意力和多Token预测,参数量745B。OpenRouter上神秘「Pony Alpha」被指是其测试版,受消息影响智谱AI港股两日涨60%。