「Claude 4.5 Haiku」共找到 3898 篇相关文章
The Batch: 945 | 制药巨头大举押注 AI
制药巨头 Eli Lilly 向 Insilico Medicine 提供最高 27.5 亿美元,用于药物研发。Insilico 用生成式 AI 进行药物发现,从靶点到分子设计效率高,虽尚无 AI 药获批,但显示出潜力。
小米神操作!认领榜一神秘模型Hunter Alpha,龙虾之父都忍不住打听
小米官宣MiMo-V2家族三款新模型Pro、Omni和TTS,其中Pro就是此前占领OpenRouter调用量榜单第一的神秘模型Hunter Alpha。它参数规模万亿,性能亮眼,Omni和TTS也实力强悍,此前身份引发全球网友好奇。
烧掉数万亿 Token、数百 Agent 连跑一周:Cursor“从零写浏览器”,结果是拼装人类代码?
Cursor CEO分享用GPT - 5.2让系统运行一周从零构建浏览器的实验,产出大量代码。但实验引发质疑,项目编译难通过,代码还依赖成熟库,像是拼装人类代码,且实验成本高。
2025年末全球 AI 行业流量报告:狂热退潮,分化开始
Similarweb报告显示,2025年Q4 ChatGPT流量同比跌22%。各AI产品走势分化,如Gemini涨49%,Claude坐“过山车”。AI编程、写作等领域也有不同表现,还揭示对传统行业冲击没那么快。
刚刚,OpenAI推出全新ChatGPT Images,奥特曼亮出腹肌搞宣传
OpenAI推出全新ChatGPT Images,由新旗舰图像生成模型驱动,特性有精准编辑、保留细节等,图像生成速度提升4倍。该功能今日向多数用户开放,价格降20%,旨在让图像生成更简单。
大模型优秀大脑齐聚硬核开源聚会,SGLang社区举办国内首次Meetup
10月25日,SGLang联合美团、亚马逊云科技在北京举办国内首场Meetup。SGLang是开源高性能推理引擎,特性丰富。活动中大咖和开发者分享见解、进展、应用场景,展现其社区活力与发展潜能。
大模型能否为不同硬件平台生成高性能内核?南大、浙大提出跨平台内核生成评测框架MultiKernelBench
深度学习计算依赖底层内核,当前多由开发者手工编写。南大、浙大推出开源评测框架MultiKernelBench,打破现有评测基准局限,构建模块化评测体系,多模型实测,还指出LLM短板并明确未来方向。
Sam Altman :GPT-6已经在路上,DeepSeek是OpenAI开源重要因素
Sam Altman称GPT-6已在路上,节奏比GPT4到GPT5间隔更快,记忆是其重要方向。他还认为美国低估中国AI,像DeepSeek等中国开源系统是OpenAI开源重要因素。
OCR-Reasoning:揭秘多模态大模型在复杂图文推理中的真实能力
主流OCR评测基准聚焦信息抽取,复杂图文推理任务中多模态大模型深度推理能力缺乏评估标准。OCR - Reasoning可系统性评估,还列举多种推理示例,并测评了Qwen2.5 - VL - 7B模型。
斯坦福临床医疗AI横评,DeepSeek把谷歌OpenAI都秒了
斯坦福最新大模型医疗任务评测,构建含35个基准测试的MedHELM综合评估框架。结果显示,DeepSeek R1以66%胜率领先,o3 - mini等模型也各有表现,还分析了成本效益。