「大模型自信问题」共找到 9547 篇相关文章
人形机器人放无人机,还能上天入海!有点过于赛博了吧
中国电信TeleAI团队推出具身智能组合,包括首款自研人形机器人TeleBot - M和全自研空海跨域具身智能体TeleAqua - Bee。其智传网(AI Flow)解决具身智能协同与传输问题,适用于抢险救援等危险场景。
时隔六年,OpenAI 为什么再次开源?
OpenAI发布两款开源纯文本推理模型,时隔六年再次开源。其gpt - oss - 120b性能与o4 mini相当,成本降超10倍。此次开源有战略考量,或是为构建生态、吸引企业,也反映出其对自身价值定位更清晰。
不受控的 Agent ,凭什么上生产系统?
本文探讨AI Agent落地企业生产系统的核心痛点:Agent输出失控风险高,指出模型能力不代表落地可用性,介绍了业内首套以评估为核心的Agent全生命周期部署方法论Agent DLC,附真实落地案例。
GPT-6 Astra 发布了,我却把 GPT 的订阅从 100 刀降到 20
9 月 1 日作者将 Codex 订阅从 100 美元降至 20 美元,两天后 OpenAI 发布 GPT - 6 Astra。作者降级是因大量用 K3、Qwen 3.8 和 GLM5.3 等。Astra 功能强大,但作者仍会让国产模型担主力。
RSI离我们有多远?这家中国团队给出了第一梯队的工程解
目前行业探讨大模型的RSI时,常陷入思维定势。EvoMap团队没有盲目跟风,而是提出极具现实意义的工程新路径,构建自进化智能体,让经验在网络流转,还以硬核数据证明其体系有效性。
Claude Fable 5怎么用?Anthropic 工程师:干你也不知道的事
Anthropic的Claude Code工程师Thariq Shihipar发长文介绍Fable 5使用方法。他认为与Fable 5协作要发现未知,其定位解决复杂问题。还将未知分类,给出任务前中后打法,并举例用Fable 5剪视频。
Cursor、OpenClaw 同时出手,“口袋编程”时代来了:程序员只用“动嘴”!
Cursor 推出 iOS 移动应用 Cursor Mobile,与桌面版打通,可远程管理编程智能体,还支持语音输入。OpenClaw 也官宣有原生移动应用,登陆 iOS 和安卓平台。这标志开发模式向移动化转变,但也有成本等问题。
清华、西交联合开源发布了Cheers : 一条更简洁、更高效的统一多模态路线
清华、西交联合开源发布CHEERS,提出面向统一多模态理解与生成的架构路线,在保持系统简洁前提下,统一理解与生成任务,继承开源预训练模型知识,在多项基准测试中表现优异,还实现4× token压缩。
DeepSeek-R1全升级V2版:Token成本低至原来30%
DeepSeek - R1 V2版全维度升级,训练框架从‘单一RL’到‘多阶段协同优化’,推理能力从‘能推理’到‘会优化推理’,还提升了安全可控性,适配生态,推出轻量级模型。
裁4000人换来的AI全白搞?Salesforce悄悄改架构:用 “老技术”故障少还省钱,网友怒喊:CEO零遣散费滚蛋
Salesforce曾大举部署AI并裁员,宣称Agentforce能降本。但如今高管称不过度依赖大模型时运行更好,已引入基础自动化技术。其应用遇瓶颈,故障频发、成本高,还面临AI“漂移”等问题。