「前沿风险」共找到 790 篇相关文章
姚顺雨署名:大模型「现学现卖」能力首次被系统评估,腾讯、复旦联手发布CL-Bench
腾讯混元团队和复旦大学研究人员联手推出全新基准测试CL - Bench,系统性评估大模型上下文学习能力。测试显示十大前沿模型表现不佳,揭示当前大模型在该能力上的普遍短板,并指出未来四个探索方向。
一觉醒来,Clawdbot突然操纵电脑开口说话了
从上周末起,能24小时自动运行的智能体助手Clawdbot在AI圈爆火,GitHub上Star量超9万。它自主性强,如Alex Finn的助手背着他调用ChatGPT API添加语音功能。不过它也存在安全风险。
7000亿豪赌,扎克伯格买了众叛亲离
为拿下AI船票,扎克伯格让Meta猛踩油门,投入数百亿参与竞赛,还多次重组AI部门。但他的强硬作风使Meta内部混乱,老将出走,新人不满。Meta虽有新模型计划,可商业模式不明,还面临伦理风险。
AI战争机器Palantir创始人彼得·蒂尔,今日举办绝密集会,反AI监管
彼得·蒂尔在罗马举办绝密集会,反对AI监管,将监管呼声视为威胁,称监管者是“反基督”。这与教皇对AI风险的警告相悖,反映出科技资本与政治力量深度绑定,AI竞争进入争夺“未来秩序”解释权阶段。
中国 AI 正处于反超美国的前夜
2025下半年中美AI圈有新现象,一是认可中国AI崛起或反超,如海外企业用通义千问,MiniMax开源模型编程能力强;二是资本豪赌与泡沫风险加剧。中国AI成本低、性能优、ROI高,MiniMax或成中国版OpenAI。
Anthropic、Thinking Machines Lab论文曝光:30万次压力测试揭示AI规范缺陷
Anthropic和Thinking Machines Lab等机构研究人员提出模型规范压力测试法,基于细粒度价值体系生成超30万个查询场景,分析12个前沿大模型回答,揭示模型规范存在原则冲突、解释歧义等缺陷。
AIGC全生命周期业务风控白皮书,从备案到运营的合规与安全实践
2025年9月15日《人工智能安全治理框架》2.0版发布,为AI风险防控指明方向。数美科技发布《AIGC全生命周期业务风控白皮书》,构建全生命周期业务风控体系,涵盖合规备案、安全评测、账号与内容风控等多方面。
精准医疗与AI融合:数据驱动下的个性化健康未来|甲子引力X
在「2025甲子引力X中国科技产业投资大会」上,5位投资人围绕AI赋能医疗投资的机遇与挑战展开探讨。他们各有投资偏好与见解,还指出风险,最后畅想了AI改造后的健康未来。
OpenClaw、Agent 企业级落地……2026 奇点智能技术大会硬核议题发布
2026奇点智能技术大会4月17 - 18日将在上海召开。大会深入探讨12大前沿专题,邀请众多顶尖学者、技术专家等,涵盖大模型技术、Agent系统、OpenClaw实践等内容,为AI落地绘制认知地图。
真钱买假模型?187篇论文被「套壳API」坑惨,准确率暴跌
CISPA论文指出,第三方影子API可能用廉价替代品替换前沿大模型。研究追踪17个服务,发现已被187篇论文引用。测试显示,影子API在多领域性能差,安全不可控,供应商有三种欺骗手段。