「安全与效用」共找到 7243 篇相关文章
美国政府变身英特尔最大股东,能帮它重新崛起吗?
路透社消息,美国政府与英特尔达成协议,将掏89亿美元买其4.333亿股普通股,占股9.9%,加上之前拨款,总投资达111亿美元。此交易引发各方争议,美国政府意在提升本土芯片制造能力。
苹果新研究:不微调、不重训,如何让AI提问效率暴增6.5倍?
苹果与牛津、港城大合作提出 BED - LLM 方法,能让 AI 解决问题能力提升 6.5 倍,无需微调重训。它基于序贯贝叶斯实验设计框架,通过三重智慧设计,经测试全面超越基准方法,或开启‘智慧对话’时代。
科普向:一文解构大模型后训练,GRPO和它的继任者们的前世今生
文章深入解读大模型后训练,先对比 PPO 与 GRPO,指出 GRPO 优势及成本问题。又介绍 GRPO 后续改进算法,如 DAPO 解决训练问题、GSPO 提升训练稳定性、GFPO 可优化多属性,还提及 GRPO 其他缺陷。
RAG2.0进入“即插即用”时代!清华YAML+MCP让复杂RAG秒变“乐高”
检索增强生成系统(RAG)复杂度提升,开发者面临高昂工程成本。基于MCP架构的UltraRAG 2.0框架,让科研人员用YAML文件声明复杂逻辑,降低技术门槛与学习成本,还提升了复杂多跳问题性能。
清华团队开源发布首个结构化数据通用大模型
2025年8月29日,清华崔鹏教授团队联合稳准智能开源“极数”(Limi X)结构化数据通用大模型。它融合结构因果推断与预训练技术,适配多任务,性能超最优专用模型,已落地多个工业场景。
EMNLP25 | 北大x腾讯光子发布 C3 Benchmark:中英双语语音对话模型“地狱级”测试基准,直击语音对话模型软肋!
近年来语音对话模型受关注,但处理人类对话复杂现象的效能缺乏研究。北大联合腾讯光子构建中英双语C3 Benchmark数据集,评估模型应对复杂对话的能力,结果揭示性能瓶颈,为模型优化提供参考,代码和数据已开源。
LLM 商业化猜想:OpenAI 会走向 Google 的商业化之路吗?|AGIX PM Notes
文章探讨了大模型商业化难题,对比 OpenAI 潜在变现方案与 Google 商业模式,分析 OpenAI 开启类似 Google 商业化引擎的可能性,还给出 AI 搜索引擎可能的变现思路,并总结了本周市场情况及 AI 公司动态。
AI 写代码这么强,为什么还是干不掉飞书多维表格?
有人认为 Vibe Coding 太强威胁飞书多维表格地位,使其独立开放。但作者认为这高估了 Vibe Coding 能力,低估了飞书多维表格复杂度与应用场景。现在 AI Coding 水平离生产级产品差距大。
投资人们都在看!「甲子引力X2025科技产业投资大会」都透露了哪些新机会? | 甲子引力X
8月21日,「渡口——甲子引力X2025科技产业投资大会」在北京举行。甲子光年创始人张一甲发布报告,总结市场趋势与投资逻辑。多位投资人参与巅峰对话、圆桌讨论,分享见解,大会还发布多个投资榜单。
ICCV 2025 | ECD:高质量合成图表数据集,提升开源MLLM图表理解能力
科研等领域图表是信息核心载体,先进开源MLLMs在高难度图表理解测试准确率低。本文提出ECD数据集,规模大、质量高、风格多样,还设计合成流水线与评测基准ECDBench,为开源MLLM提供支持。