大模型3.0」共找到 10117 篇相关文章

产品应用7

不换 Kimi 底座,1/10 成本追平 Opus 4.7?Cursor 用 Composer 2.5 反击 Claude Code

Cursor 发布 Composer 2.5 应对竞争,虽沿用 Kimi K2.5 底座,但通过后训练提升性能。它跑分接近 Opus 4.7,价格更低,在长任务处理上表现更好,还公布多项技术进展,正推进模型训练。

InfoQ
算法论文8

Agent接管EDA工作流,不只写脚本!浙打通真实芯片设计闭环

模型正以Agent形态进入真实EDA工具链。浙卓成团队构建OpenClaw + FluxEDA联合架构,打通关键链路,解决模型操作真实EDA工具的难题,在多任务中完成连续分析与优化闭环,推动EDA工作流范式转变。

新智元
新闻资讯7

谷歌新版Gemini马甲被扒! LMArena实测:唯一能看懂表的AI, GPT-5乱答

谷歌Gemini 3.0疑似上线LMArena,其Pro和Flash马甲被扒。实测中,Gemini 3 Pro能精确看表,GPT - 5等表现不佳;SVG测试有提升但也有不足;还能作曲。不过评测方式老套,希望有新花样。

新智元
算法论文8

Knowledge还是Reasoning?具体分析LLM答案正确,不代表思考过程靠谱的问题

斯坦福/加州学团队指出模型答案正确不代表思考过程靠谱,传统评估忽略思考路径问题。团队提出双维度评估框架,透视模型思考过程,还测试发现不同领域决胜关键、最佳训练法不同,且框架正解锁新场景。

深度学习自然语言处理
新闻资讯7

内行被外行指导、时刻担心被裁,Meta 人现在迷茫又内卷

据《金融时报》报道,Meta首席AI科学家Yann LeCun计划离职创业。他不满公司内部变化,与扎克伯格战略分歧。Meta近年受模型冲击,内部现‘外行指导内行’、员工迷茫内卷等问题,还要求元宇宙部门用AI提效5倍。

AI前线
新闻资讯7

Mistral 为 Le Chat 新增远程智能体与 Work 模式

Mistral发布1280亿参数的Mistral Medium 3.5模型,在Vibe和Le Chat引入云端智能体能力,还在Le Chat新增Work模式。新模型可自托管,支持长上下文窗口。社区反馈积极,开发者认可,也有人嫌定价贵。

InfoQ
推荐文章8

从混沌到可控:企业应用中AI Agent不确定性控制的 10 种策略

语言模型输出的不确定性限制了AI智能体在企业场景的应用,本文总结控制生成式AI Agent不确定性的常见策略,涉及技术、应用设计、管理与治理层面,还推荐了相关作品。

AI大模型应用实践
新闻资讯7

2025 上半年具身智能融资复盘:金额超 200 亿、头部收敛趋势明显、传统制造业巨头增多

2025上半年具身智能融资火热,截至7月16日融资事件130件,预估总融资超200亿。资本从模型转向具身智能,且向头部企业聚拢,厂与传统制造巨头积极投资,不过行业仍处早期,上市前景待察。

AI科技评论
产品应用7

Codex正式开放1M上下文!解除GPT-5.6 Sol封印,三行配置搞定

现在3行配置就能让GPT - 5.6 Sol封印解除,在Codex里用上1M上下文。不过有网友警告轻易别用,因超出默认窗口,模型消耗token速度会翻倍,且模型上下文利用能力会下降。此外,Codex确定会上Astra。

量子位
产品应用8

AI云的考来了:企业要的不再是参数,而是盈利 | 甲子光年

历经3年模型热潮,AI云市场提问改变,企业更关注平台模型实用性和故障恢复能力。百度云智会聚焦新一代智能基础设施与平台升级,其智能云连续六年排名第一,此次升级回应企业落地AI的核心问题。

甲子光年