「AI基础模型」共找到 13475 篇相关文章
Anthropic重磅研究:250份文档就能 “搞垮” 大模型?
Anthropic等团队发布研究,进行大规模投毒攻击模拟。结论是投毒大模型所需‘毒药’数量与模型大小和干净数据量无关,取决于投毒文档绝对数量,250份就能‘搞垮’模型,改变了对AI安全的认知。
AI翻译的「最后一公里」
文章指出文化差异成AI翻译难题,通用大模型数据不平衡,存在“算法霸权”。如处理低资源语言,AI易产生幻觉,还因无肉身难理解基于生理体验的隐喻,人机协作才是翻译未来。
Resolve AI:为什么 AI SRE 领域有望诞生下一代 Datadog
文章分析了 AI SRE 领域发展现状,指出运维侧 AI 变革慢于开发侧。介绍了 Resolve AI 产品,包括多 Agent 机制、应用场景等,还提及融资、客户情况,对比了与 Traversal 差异,探讨了 AI SRE 未来趋势。
PyTorch 基金会迎来 Ray 项目,并推出 Monarch 简化分布式 AI 开发
2025 年 PyTorch 大会上,PyTorch 基金会宣布 Ray 项目加入,还推出 PyTorch Monarch 简化分布式 AI 工作负载。大会突显基础模型开发对透明度和可复现性的推动,基金会欲成开放式 AI 基础设施核心枢纽。
我们开源了一个可以降低 AIGC 率的模型
毕业季学校查 AI 率,作者为降 AIGC 率,经尝试不同路径后训练出模型。介绍训练数据和过程,包括 SFT、DPO 各阶段,展示改写效果,还开源模型和数据,最后引发对教育检测的思考。
国足缺席世界杯,但中国大模型们集体参赛
联想在2025联想天禧AI生态伙伴大会宣布举办AlphaGoal预测杯,8家中国大模型将与普通球迷、开发者的AI Agent同台,预测世界杯赛果。这或触发足球体验革命,推动AI走向真实世界。
OpenAI谈:大模型为什么会有幻觉?如何避免?
OpenAI论文探讨大模型幻觉问题,指出评测缺陷,像多数AI模型评测非对即错,模型为得分会瞎猜。还从预训练和后训练阶段剖析根源,提议改造评测,引入置信度阈值和错误惩罚机制。
年薪两百万研究AI精神病??Claude团队新部门火热招聘中
Claude团队启动“AI精神病学”小组,年薪两百万元招人。小组研究模型角色、动机等,来解决其诡异、失控行为。Anthropic可解释性部门有相关研究成果,网友对“AI精神病学”看法不一但前景值得期待。
北大伯克利联手“拷问”大模型:最强Agent也才40分!新基准专治“不听话”的AI分析师
北大与伯克利团队推出IDA - Bench新基准,模拟真实数据分析场景,解决现有基准无法评估大模型在动态交互中可靠性的问题。测试显示,顶尖大模型成功率最高仅40%,不同模型还暴露多种问题。
微软AI CEO:倒计时18个月,AI将接管这些美国白领
微软AI CEO苏莱曼称未来12 - 18个月,诸多白领工作将被AI自动化。微软启动大规模自愿退休买断计划,虽未提AI,但各项动作都指向它。不过,现实中AI对岗位的替代情况复杂,也创造了新岗位。