「智能科技」共找到 4066 篇相关文章
如何重现 DeepSeek 推理性能突破
DeepSeek-V3 是热门开源大模型,采用大规模 MoE 架构,优化推理性能是工程难点。阿里团队在 RTP - LLM 完成优化,对齐其推理系统性能,分享关键技术、不足与思考,还提及对 Qwen3 模型的优化策略。
翁荔最新万字长文:Why We Think
北大校友、前OpenAI华人VP翁荔发布万字长文《Why We Think》,围绕“测试时计算”和“思维链”,探讨提升模型性能的方法,涉及心理学类比、基于Token的思考、分支与编辑等多方面内容。
国行苹果与阿里的AI 合作,正遭遇美政府狙击!
据《纽约时报》5月17日报道,白宫和国会官员严格审查苹果与阿里巴巴的AI合作计划。苹果因在中国市场销量下滑、缺乏AI功能,急需本土伙伴;而美国政府担心交易助中企提升能力等。
Borg调度进化了!谷歌超强AI Agent 登场:能设计算法、提效系统,陶哲轩亲自助攻,网友封神理科扛把子!
谷歌 DeepMind 推出由 Gemini 驱动的 AI 智能体 AlphaEvolve,能设计算法、提效系统,破多项数学记录。它已用于谷歌多领域,还将探索材料、药物研发等领域,也计划推早期访问计划。
突发,美商务部叫停「AI扩散规则」藏杀机!英伟达市值再破3万亿
13日晚美商务部撤销《AI扩散规则》,该规则曾遭科技巨头和盟友反对。同时出台加强半导体出口管制新措施,精准打击中国AI发展。而英伟达因规则废止受益,市值再破3万亿。
文生图进入R1时代:港中文MMLab发布T2I-R1,让AI绘画“先推理再下笔”
港中文MMLab团队发布首个基于强化学习的推理增强文生图模型T2I - R1。它提出双层级CoT推理框架和BiCoT - GRPO强化学习方法,解决生成评估难题,为多模态生成提供新范式。
4月30日凌晨,Meta举行首届AI开发者大会LlamaCon,推出Meta AI聊天机器人应用程序与ChatGPT竞争,发布Llama API。Meta试图强化开源模型生态系统以限制OpenAI发展,扎克伯格与微软CEO还探讨了开源闭源模型生态等内容。
开源模型两个月内杀死比赛
过去60天,Vercel AI Gateway调用数据显示,开源模型Token调用份额从28%涨至62%,反超闭源模型。英伟达60亿美元入局扶持,闭源虽推新降价仍失领先,开源走向大规模应用。
史上最大IPO要来了
据英国《金融时报》,全球头部AI企业Anthropic最快10月上市,估值或达2万亿美元,将超SpaceX成史上最大IPO。其营收增长快,靠编程等企业级业务逆袭,还引得众多科技资本下注。
终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成
过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合多机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。