「预发布模型」共找到 9137 篇相关文章
3B激活参数!商汤绝影Sage登顶PinchBench,端侧第一
商汤绝影Sage端侧大模型在PinchBench评测中,以94%任务完成率超越Claude、GPT - 5.4等主流大模型。它激活参数仅3B,算力需求低,还具备多项实用场景能力,靠SCOUT和ERL两项自研技术提升性能。
“现在的AI就像1880年的笨重工厂!”微软CSO斯坦福泼冷水:别急着造神
微软首席科学官 Eric Horvitz 在斯坦福商学院演讲,称当下 AI 如 1880 年代刚用电的工厂,底层大模型与商业未契合。他指出模型概率校准不足、医疗 AI 难移植等问题,还谈及人类与 AI 协作及内容溯源等。
世纪反转:“安卓爹”谷歌成 iPhone“大脑供应商”?曝苹果每年掏70亿换定制Gemini,明年上线新Siri
彭博社报道苹果将与谷歌合作,每年付约10亿美元获定制Gemini模型升级Siri,计划明年春季推出。Gemini与苹果自研模型分工,经测试它更符合苹果需求,此合作资金流向反转引网友热议。
谷歌认领最强AI版Photoshop!现在人人可用,效果确实强悍
谷歌认领神秘图像编辑模型nano - banana,即Gemini 2.5 Flash Image。它可免费在Gemini和Google AI Studio使用,API收费。该模型图像编辑能力出色,能合并图片、实现2D到3D转换等,此前爆火却无官方文档。
张小珺采访了Kimi杨植麟,Agent泛化的临界点来了。
张小珺采访Kimi杨植麟,杨分享技术见解。如Scaling Law遇瓶颈,应提升Token效率;Adam与Muon对比,Muon学习效率高;模型公司下场做一方Agent产品,垂直整合模式上限高;还谈及长上下文、Agent训练及管理方式等问题。
对话原力灵机范浩强:评判机器人好坏,只有一个指标
本文是对原力灵机创始人范浩强的访谈。他认为AI是一生的事业,原力灵机成立于25年3月,强调模型是主轴。还指出评判机器人好坏的关键指标是回本时间,要从真实场景找突破,也介绍了具身智能应用等内容。
告别「想完再做」卡顿!清华StreamingVLA让VLA边想边行动,提速2.4倍
视觉 - 语言 - 动作(VLA)模型“观测 - 生成 - 执行”串行模式致交互卡顿,清华与联想合作提出StreamingVLA框架,引入两项技术实现并行处理,在测试中显著提升效率和流畅度,为VLA模型部署提供新方案。
「回答一切」吐槽潮中 Sam Altman 确认: 4o 回归,GPT-5 将进行六大改进
OpenAI在Reddit举行GPT - 5问答活动,网友吐槽多。Sam Altman确认GPT - 4o回归,还表示GPT - 5将进行加倍调用速率、保留旧模型选择权等六大改进,同时回应了用户对旧模型、调用限额等方面的质疑。
毫无征兆!DeepSeek R1爆更86页论文,这才是真正的Open
两天前,DeepSeek悄无声息把R1论文从22页更新到86页,将其升级为开源社区可复现的技术报告。新论文干货多,如精确数据配方、基础设施说明等,且多项实力媲美甚至赶超OpenAI等闭源模型。
困住医疗AI的死循环,终于有国产玩家跑通了
文章指出医疗AI行业因数据、模型、场景闭环断裂陷入困境,整体渗透率低。讯飞医疗的星火医疗大模型V3.5评测和临床落地表现出色,其构建自强化循环体系,跑通死循环,或使行业马太效应渐显。