「可灵O1模型」共找到 10005 篇相关文章
4个MIT的00后,两年干出全球最火AI编程工具,600亿美元卖给了SpaceX
今年1月,Cursor CEO Michael Truell决定训练自有模型,不再依赖Anthropic的Claude。5个月后,SpaceX以600亿美元收购Cursor母公司。此前Cursor增长快但依赖Claude,自研模型有成本优势却缺算力。
谷歌NotebookLM终于说中文了!这可是最火的大模型播客产品
NotebookLM正在变成谷歌AI路线里靠谱选手,现支持中文播报且将推移动App。它能将音频源转化为类似播客的对话,有摘要等功能,音频概览功能受欢迎,底层是谷歌Gemini 2.5 Flash,实用性强,即将上线安卓和iOS版App 。
不靠Agent,4步修复真Bug!蚂蚁CGM登顶SWE-Bench开源榜
蚂蚁集团代码图模型 CGM 基于开源模型,不靠 Agent 架构,用 4 步轻量级流程完成仓库级代码修复,在 SWE - BenchLite 公开排行榜成绩亮眼,打破闭源垄断,还解决了 LLM + Agent 架构的一些问题。
Claude 4 要来了!
AI专家在Anthropic前端配置发现Claude 4痕迹,其或有查看AI思考过程功能。当下OpenAI、Google、xAI等对手来势汹汹,Claude 4压力大,但可在可解释性等方面破局,预计5月22日公布。
智谱定档大模型第一股,1月8日挂牌上市,IPO预募资43亿港元
智谱定档2026年1月8日在港交所主板挂牌上市,预募资43亿港元,上市后市值预计超511亿港元。它是中国最早开展LLM研发的公司,多模型表现亮眼,靠MaaS模式实现盈利,但研发投入巨大。
Mythos限测首日破防,论坛玩家猜网址就摸进门了
4月7日,Anthropic新模型Claude Mythos Preview限量发布,当天就有未授权用户猜出在线地址获得访问权限。Anthropic称未发现自身系统受影响,该模型对齐表现较好,但训练有技术错误。
加入Meta近一年,亚历山大王回应:超级智能之前,AI终局未定
亚历山大·王加入Meta近一年后携Muse Spark模型回归,回应诸多争议。他指出Llama 4发展不符要求,Meta缺超级智能信仰。介绍了Meta超级智能实验室架构原则,还谈到算力分层、模型福利等内容。
递归神经网络的复兴:Mixture-of-Recursions
Google DeepMind研究者设计的语言模型,能判断关键单词并进行深度递归计算,通过轻量级“路由器”节省计算资源,在同等训练成本下表现显著优于传统模型,文中还提及其他解决动态算力分配问题的思路。
DeepEval:LLM 应用评测不再玄学,让大模型评测像写单元测试一样简单
在大模型应用开发中,科学、自动化评测 LLM 输出质量是难题,人工评测效率低。DeepEval 是 Confident AI 团队开源的 LLM 评测框架,能用极简代码让评测像写 pytest 一样自然,内置多种评测指标,支持批量评测等。
这个春节P图不求人!小红书开源图像编辑新SOTA
今日小红书基础模型FireRed - Image - Edit亮相,在复杂编辑指令、风格化转换等核心指标表现强,在多项权威测试达SOTA。该项目代码等已开源,模型权重将开源。团队还推出RedEdit Bench评测方案。