「可验证」共找到 4567 篇相关文章
开源模型竟被用于窃取下游微调数据?清华团队揭秘开源微调范式新型隐藏安全风险
清华、墨尔本大学团队研究指出,基于开源模型微调专有模型存在新型隐藏安全风险,开源模型发布者可埋后门窃取下游微调数据,新风险难检测、危害大,目前攻防方法待改进。
被低估的ChatGPT新功能,10分钟搞定DeepSeek代码库深度研究
ChatGPT悄悄上线直连Github新功能,能自动读取、解析并总结整个GitHub仓库,可快速输出专业研究报告,应用场景广,还能避免“幻觉”,Plus用户即可用,开启全新研究模式。
Gemini 2.5 Pro登顶三冠王!AI最强编程屠榜,全面碾压Claude 3.7
谷歌Gemini 2.5 Pro(I/O版)横空出世,登顶LMAreana获文本、视觉、编码三连冠,编程能力碾压Claude 3.7。开发者可通过Google AI Studio等使用,其应用演示展现强大实力。
给优秀实习生期权!刚刚,一项面向AI顶级人才的「面壁计划」启动了
面壁智能发布「前进四」顶尖人才计划,面向优秀实习生,符合条件者毕业前可提前获期权。该公司过去一年成长迅速,提前押注端侧、首创「密度定律」且坚定开源,成果丰硕。
评审用不用AI,作者说了算?ICML 2026全新评审政策出炉
ICML 2026 引入评审类型选择机制,作者可决定评审是否用大语言模型。政策 A 禁止,政策 B 允许但有限制。不过大模型使用规定执行难,此规则更像约定。
99%的人都不知道:MCP 必须在 Claude Code 外面装
作者分享飞书MCP安装经验,指出MCP要在Claude Code外安装,介绍用Cursor生成安装命令、验证安装、删除服务等技巧,还整理《MCP安装指令文档》,复制粘贴就能用。
Sora 为什么输给 Codex?
本文探讨Sora输给Codex的原因。奥特曼称因Sora太吃compute,Codex优先级更高。Sora算力连续独占,成本难摊薄;Codex算力碎片可复用,能交错服务多任务,资源回报曲线更好。
Cloudflare 推出 Meerkat,实现全球强一致性协调
Cloudflare推出基于QuePaxa共识算法的Meerkat服务,可无领导者写入并保持强一致性,提升网络可用性。虽有往返通信代价且非通用数据系统,但优化对强一致性系统重要,还未投入生产。
重磅!Anthropic内部神秘模型在黎曼猜想上取得突破:关键下界从41.6%推到67.2%
A厂宣布Claude在黎曼猜想相关问题取得进展,其内部研究版Claude将黎曼ζ函数零点满足猜想比例的已知下界从41.6%提升到67.2%,经数学家验证,结果意外且有新方法。
这个Skill太香了!Karpathy说的AI写代码的毛病,直接治好
GitHub上的开源Skill andrej - karpathy - skills受Karpathy启发,能解决AI写代码的毛病。它将Karpathy洞察提炼成四条原则改造AI Agent行为,安装简单,可自定义,能约束Agent,让开发者关注关键判断。