「大模型公司」共找到 10046 篇相关文章
Cursor 删库9秒毁了一家公司?资深开发者讲了大实话:把数据库交给AI的那一刻,公司就已经没了
初创公司 PocketOS 创始人 Jer Crane 称,Cursor 平台上的 AI 编码代理 9 秒删光其生产数据库及备份,导致客户服务中断。这一事件引发热议,有人认为是公司决策失误,也有人探讨了 AI 犯错时的责任归属。
Meta与Midjourney合作,集成在新模型中
Theverge消息,Meta首席人工智能官宣布将Midjourney技术整合到未来AI模型和产品。合作对Meta意义大,可对标领先模型。Meta早有布局,Midjourney发展快且营收可观,采用订阅制。
20岁了!劈柴哥发帖庆生:谷歌翻译换了4代AI,第一次有了「呼吸感」
4月28日,Google Translate满20岁,Pichai发帖纪念,回顾其技术发展,从统计模型到神经网络,再到Gemini原生语音模型,Translate不断进化,能保留语调和节奏,虽被大模型抢风头,但仍在持续进步。
开源多模态推理「破壁」时刻:MMFineReason助力4B逆袭30B
长期以来,开源多模态模型在复杂推理任务上与顶尖闭源模型有差距,核心痛点是高质量推理数据匮乏。上海AI实验室OpenDataLab团队开源MMFineReason框架及大规模数据集,小模型凭此实现性能逆袭。
不止Deep,更要Wide:清华、无问芯穹发布多智能体系统WideSeek-R1,4B模型比肩671B模型!
清华与无问芯穹的RLinf团队提出「广度扩展」,发布多智能体系统WideSeek-R1。它采用「Lead-agent-Subagent」框架,经MARL端到端训练,4B模型在广度搜索任务表现比肩671B模型,且在标准QA任务也出色。
同样的模型,Claude Code凭什么比Codex强
文章探讨决定 Coding Agent 能力的 6 大核心组件。指出如今旗舰模型‘裸机’能力相近,真正拉开体验差距的是 Harness 工程质量,还开源 Mini Coding Agent 实现六大组件。
医疗AI迎来大考!南洋理工发布首个LLM电子病历处理评测 | AAAI'26
南洋理工大学研究人员构建EHRStruct基准,涵盖11项核心任务、2200个样本,用于评测LLM处理结构化电子病历的能力。研究发现通用大模型优于医学专用模型,提出的EHRMaster框架与Gemini联合后性能超现有模型。
DeepSeek-R2尚未问世,微软小模型捡漏称王?6000样本炼出「数学作弊器」!
微软推出Phi-4推理模型系列,参数最多14B,能在本地高性能笔记本电脑上流畅运行。Phi-4-mini-reasoning在数学推理上性能超越DeepSeek-R1蒸馏模型,且参数规模更小。文章还介绍了模型特点、训练方法、性能表现及局限性等。
公司业绩大爆发,芯片大佬身家逼近两百亿
在《2025新财富500创富榜》中,瑞芯微大佬励民身家173.8亿成福州第二富豪,财富较去年涨73%。他2001年创立瑞芯微,多次带领转型。近年公司业绩佳,但大股东抛减持计划,且面临行业风险。
多模态推理新基准!最强Gemini 2.5 Pro仅得60分,复旦港中文上海AILab等出品
现有多模态大模型benchmark对逻辑推理理解不足,复旦大学等单位提出MME - Reasoning评估其推理能力。对30 + 模型评测,最优得分仅60%左右,反映出模型多方面推理短板。