「性能拐点」共找到 1968 篇相关文章
太初元碁乔梁:AI算法已经跑到单芯片极限|MEET2026
在量子位MEET2026智能未来大会上,太初元碁乔梁表示,当下AI算力需求指数级增长,超智融合成行业共识。单颗芯片性能成瓶颈,太初元碁设计PC link实现芯片互联,还分享了HPC+AI在多领域的落地实践。
SD又回来了!一秒出图,手机就能玩:SD3.5-Flash让专业AI绘画进入“闪电”时代
Stability AI联合萨里大学SketchX实验室推出SD3.5-Flash模型,能在普通电脑甚至手机上快速生成专业级高分辨率图片。它将推理步骤压缩、显存要求降低、出图时间大幅缩短,画质也没明显缩水,还在性能上反超SD3.5M。
对话王小川:换个身位,做一家「医疗突出」的模型公司
百川智能创始人王小川与极客公园创始人张鹏长谈。百川曾快速扩张后调整,聚焦医疗。其新发布的医疗大模型Baichuan - M2性能优异,超OpenAI两开源模型。王小川认为造AI医生复杂,且AI家庭医生会比无人驾驶更早到来。
具身智能开始“交卷”:宇树上市之后,产业和资本怎么走?|甲子引力X
2026年8月20日,「激流——2026甲子引力X·科技产业投资大会」举行,聚焦人工智能等硬科技方向。会前一天宇树科技上市,股价波动引发对具身智能估值的讨论。会上投资人探讨了具身智能从技术到产业化的变化、拐点、资本市场走向等问题。
The Batch: 885 | Claude 升级了
Anthropic更新中型模型Claude Sonnet至4.5版本,在性能上显著提升,还引入可变推理token预算。Claude Code智能编码工具也获功能增强,新增Claude Agent SDK等。测试中Claude Sonnet 4.5表现优异,Anthropic重心转向编码与职场生产力。
成立 5 年最高估值超百亿,摩尔线程之后,又一家AI芯片独角兽争当“国产 GPU 第一股”
6月23日,沐曦集成电路IPO辅导完成,离A股上市更近一步。它成立于2020年,专注高性能GPU,产品应用广,还与书生・浦语3.0合作。虽曾被曝裁员,但已完成8轮融资。当下国产GPU厂商扎堆IPO,适配DeepSeek或带来机遇。
Karpathy刚开源的autoresearch,我拿来优化龙虾skill,成功率从56%飙到92%
Karpathy发布开源项目autoresearch,可让AI优化AI。作者分享用其优化skill的实践,介绍优化流程,指出可将模糊表述拆成可判断是非题,还提及定义评估标准的方法与常见错误修正。此外,还能用于代码性能优化。
消费级显卡可以快速上手跑!面壁智能MiniCPM-o 4.5发技术报告
面壁智能联合多方发布MiniCPM-o 4.5技术报告。该模型是业界首个端到端全双工全模态大模型,参数约9B,依托Omni - Flow框架,多项性能对标前沿大模型,还推出多种使用方式,兼顾普通用户与开发者需求。
神秘霸榜模型现真身:小米MiMo-V2 Pro,国内首个万亿参数+1M上下文,为Agent而生!
小米全新一代面向 Agent 的大模型家族官宣,包括 MiMo-V2-Pro Preview、MiMo-V2-Omni 和 MiMo-V2-TTS。MiMo-V2-Pro 性能优异,在多场景实测表现出色,技术有创新,API 开放且定价低,已融入小米多业务与生态。
ICLR 2026 | 越推越快! 首个面向「Test-Time Scaling」的投机解码基准
文章指出推理阶段扩展(TTS)能提升推理大模型解决复杂问题的能力,但会产生大量冗余计算。为此提出首个面向TTS的投机解码加速综合基准,评测显示N - gram方法在特定场景加速潜力大,混合策略性能更优。