「企业级能力」共找到 4829 篇相关文章
独家丨国内人形机器人首笔千台级商单出现
AI科技评论独家获悉,星尘智能与仙工智能达成人形机器人千台级订单战略合作,今年4季度起部分交付。这是国内人形机器人在工业领域最早一批千台级商单,双方采取‘供应链+产品+渠道’合作。
从0到1搭建生产级Agentic AI系统:踩坑心得
作者拆解GitHub上生产级Agentic AI系统项目,指出生产级AI系统要把‘稳定性’‘容错性’‘可运维性’融入代码。介绍了项目在环境配置、LLM调用容错、日志监控等方面的设计,还给出工程化落地避坑指南。
Monet:赋予多模态大模型如人类一般的抽象视觉思考能力
文章介绍了Monet模型,它实现了训练MLLM直接在连续隐空间思考的方法,内化视觉思考能力。还阐述了多模态模型隐式推理训练的难点,提出SFT+RL训练框架,构建数据集,经测试,Monet提升了视觉推理能力。
刚刚,马斯克Grok 4.1低调发布!通用能力碾压其他一切模型
xAI 低调发布 Grok 4.1 并向所有用户开放,可多平台使用。该模型在真实世界可用性上显著提升,尤其在创造力等方面出色。它在多项评估中表现优异,通用能力领先,情感智能、创意写作佳,还降低了事实幻觉。
编程能力开源SOTA,网络安全提升2倍!智谱发布GLM-5.3
智谱发布GLM-5.3,743B参数模型,编程能力达开源SOTA。网络安全能力涌现,基准得分是GLM-5.2两倍多。全部提升来自后训练缩放,还自研Z.ai Code Bench评估,安全评估加固后权重将开源。
正确答案 ≠ 正确推理,CoT 或成大模型推理能力停滞的「罪魁祸首」?
研究指出当前大模型推理能力评估多关注答案准确性,忽视推理步骤。通过对前沿模型测试发现,2023 - 2024 年大模型推理能力提升停滞,进步靠提示工程,自底向上策略最有效。
企业出海,被中国信通院和腾讯重新定义了一次
中国企业出海面临信息分散、专业支撑不足、属地化服务难等问题。7月17日,中国信通院与腾讯在2026世界人工智能大会共赢金砖论坛上推出AI航海家+,将七国生意经装进AI对话框,有22位懂当地规则的专家,能替企业做判断。
98%财务顾问依赖AI,揭秘7家先锋企业如何解锁商业新格局
OpenAI报告剖析7家前沿公司应用AI经验。如摩根士丹利评估后让98%财务顾问用OpenAI;Indeed用GPT - 4o mini优化职位匹配;Klarna用AI客服助手提升效益等,展示AI重塑企业运营的潜力。
DeepMind华人研究员Lun Wang离职,「评估」成制约模型能力飞跃的瓶颈
谷歌DeepMind研究员Lun Wang离职后发文指出,当下评估体系难以应对新模型,制约模型能力飞跃。现有评估多针对当前模型,新能力出现时往往无法预测,需构建能自我进化的评估系统。
打破长视频理解瓶颈:HoPE混合位置编码提升VLM长度泛化能力
如今视觉语言模型在长上下文任务表现不佳,CMU和小红书团队深入研究,首次提出多模态RoPE扩展策略理论评估框架,指出现有泛化能力不足原因,提出HoPE大幅提升VLM长度泛化能力。