「标准残差」共找到 690 篇相关文章
R1一周年,DeepSeek Model 1悄然现身
2025年1月20日,DeepSeek发布DeepSeek - R1开启新开源LLM时代,其在Hugging Face获赞最多。一年后,DeepSeek新模型Model1在GitHub现身,经Gemini分析或为DeepSeek - V4,还给出相关技术细节。
不到百万级,看不见 MCP 的真实问题:创始人亲述这疯狂的一年
本文是对 MCP 联合创作者 David Soria Parrra 的访谈,回顾 MCP 从发布到成为行业事实标准的历程,探讨其演进、应用、竞争对手等问题,还分享经验教训,展望未来发展方向。
我们对 Coding Agent 的评测,可能搞错了方向
用户对 Agent 不满常因它「做得不好」,不遵循指令和规范。当前主流评测体系以结果为导向,与真实场景错位。MiniMax 开源 OctoCodingBench 评测集,结果显示模型过程规范遵循不足,未来训练需引入过程监督。
Karpathy新思考:别把AI当动物,它们是全新的智能物种
Andrej Karpathy发长推提出颠覆性观点,认为人们用错误框架理解AI,对比了动物智能与LLM智能的优化动力、根本差异等,强调优化目标决定智能形态,指出应按其机制对待AI。
ICLR 2026出分,审稿员怒喷「精神病」!DeepMind研究员教你绝地求生
ICLR 2026评审结果公布,投稿量近2万篇创新高,但分数滑坡,平均分从5.12跌至4.2。审稿人吐槽质量低,甚至有怒喷‘精神病’的情况。DeepMind研究员提供论文反驳指南,称同行评审像‘随机数生成器’。
Nature新研究:AI竟然分不清事实和信念
斯坦福大学团队在Nature发表研究,测试15个大模型,发现其区分事实、信念和知识存在严重缺陷。如处理第一人称信念准确率低,对语言线索依赖高,在高风险领域应用令人担忧。
独家丨滴滴悄咪咪上线了个「AI 图寻」产品
2013 年 GeoGuessr 地理猜测游戏走红,衍生出「图寻」玩法。2024 年 AI 让“猜地点”能力大增。今年滴滴悄悄上线 AI 图寻产品「在哪儿问问」,具实用工具属性,但 AI 识图在冷门场景表现欠佳。
硅谷惊变:12万张H100的挽歌
这是虚构故事,Meta用12万张英伟达H100训练“LLaMA 4 Maverick”,却被中国杭州DeepSeek团队用2000张GPU打败。项目失败成丑闻,扎克伯格成立实验室四处收购遇冷,新负责人管理混乱,实验室乌烟瘴气。
腾讯混元开源游戏AI生成新工具!RTX 4090就能制作3A级动态内容
腾讯开源游戏视频生成框架Hunyuan - GameCraft,基于混元视频生成搭建,操作简单,输入单张场景图、文字描述和动作指令就能生成高清动态游戏视频,解决传统工具瓶颈,性能优于主流模型。
程序员面试变天:Meta 破例允许在编程面试中使用AI
Meta允许求职者在编程面试中使用AI,这一决定与Amazon等科技巨头不同。扎克伯格对AI编程很有热情。网友看法不一,Meta回应称此举合理,还计划在招聘中更广泛用AI,强调人际交流仍是面试一部分。