「技术成年礼」共找到 4927 篇相关文章
DeepSeek最新模型意外泄露~
DeepSeek最新模型DeepSeek-V3-0526疑似泄露,消息源于https://docs.unsloth.ai/basics/deepseek-v3-0526-how-to-run-locally ,其性能媲美GPT - 4.5 / Claude Opus,或成最强开源模型,信息若属实将很快发布。
世界模型的DeepSeek时刻!魔芯Flash World Model降本70%,跑出50FPS实时交互
魔芯科技发布全球首个超高帧率交互式世界模型 MoWorld,无需高端 GPU,实现影视级画质、50 FPS 实时交互,降本 70%。其技术架构先进,产业化路径清晰,获过亿美元融资。
中国首次提出半导体演进新原则:华为“韬定律”5 年内冲刺等效1.4nm制程,麒麟、昇腾将先后落地量产
5月25日,华为何庭波在研讨会上提出“韬定律”,以“时间缩微”替代“几何缩微”。论文展示验证案例,预计2031年高端芯片达1.4nm等效水平,今年秋季麒麟新芯片将首发“逻辑折叠”技术。
Mythos限测首日破防,论坛玩家猜网址就摸进门了
4月7日,Anthropic新模型Claude Mythos Preview限量发布,当天就有未授权用户猜出在线地址获得访问权限。Anthropic称未发现自身系统受影响,该模型对齐表现较好,但训练有技术错误。
撕开Claude Code真相:让它好用的98.4%,是工程不是AI
X用户推文曝光Claude Code项目模板,实则是公开范式。研究显示Claude Code 98.4%是工程基建。OpenAI等团队已将AI编程跑成生产线,普通开发者也能搭建入门版基建。
美团又上新模型,8个Thinker齐开工,能顶个诸葛亮?
临近春节,美团 1 月 15 日更新 LongCat - Flash - Thinking - 2601 模型。它有 5600 亿参数,引入重思考模式,智能体能力提升。实测表现佳,适合特定场景,其技术改进独特,还将推出 ZigZag Attention。
刚刚,Geoffrey Hinton成为第二位引用量破百万的科学家
Geoffrey Hinton成历史上第二位Google Scholar引用量破百万的计算机科学家。介绍其出身、求学、学术成就,他晚年警示AI风险。还提及他两名得意门生Alex Krizhevsky和Ilya Sutskever的情况。
DeepSeek-OCR是「长文本理解」未来方向?中科院新基准VTCBench给出答案
DeepSeek - OCR的VTC技术可实现高压缩率,降低长文本处理成本。但视觉语言模型能否理解压缩信息存疑,中科院等推出VTCBench评估,测试模型认知极限,还推出VTCBench - Wild检测鲁棒性。
摩尔线程新一代GPU架构10天后发布
2025年12月19 - 20日,摩尔线程首届MUSA开发者大会将在北京举行。大会聚焦国产算力,主论坛将发布新一代GPU架构,还有20+技术专场和1000㎡科技嘉年华,官网已开放报名。
当云计算开始在硅谷“造星”,一场自我革命开始了
亚马逊云科技在2025 re:Invent大会尽显号召力,新锐Decart AI、TwelveLabs等借其技术蹿红,苹果也分享成果。它还进行自我革命,优化性能,构建生态,其中国行也即将开启。