「模型公司」共找到 8931 篇相关文章
YOLO12改进引入DINOv3少样本目标检测精度飙升,分享训练自定义数据集代码
Meta 人工智能研究院的 DINOv3 是基于自监督学习的视觉大模型,解决诸多问题且无需微调,在多任务表现出色。将其引入 YOLO12 后,在不同规模数据集上检测性能显著提升,还分享训练自定义数据集代码。
焦虑的贝索斯,决定先裁30000人
亚马逊启动史上最大裁员,先裁14000人,明年或再裁。表面因疫情后人员冗余,实则源于AI军备竞赛压力,AWS优势缩小。公司还计划用机器人替代超50万员工,中层和初级岗位受冲击大,H - 1B员工处境艰难。
GPT-5被批过度炒作、性能落后,OpenAI联创揭秘其中原因:我们把它关在 “象牙塔”,和现实世界接触不够
OpenAI发布GPT - 5后遭遇波折,因被批不直观恢复为GPT - 4。但它是进军企业市场举措,获部分企业认可。OpenAI联合创始人Greg Brockman谈其发展历程、瓶颈、应用等,强调让模型接触现实、提升安全性及适配团队工作。
华为版CUDA,全面开源了
华为宣布为昇腾AI GPU开源CANN软件工具包及Mind系列套件、工具链,让昇腾更好用。CANN类似华为版CUDA,目前到8.0版,支持多深度学习框架。同日,传奇GPU架构师创业公司浮出水面,挑战英伟达。
0.016%参数撬动18%性能:关键表征微调破解LLM推理瓶颈
大语言模型在推理任务依赖思维链技术,传统PEFT方法需修改大量参数,新兴ReFT虽只需调整少量参数,但存在不足。本文提出CRFT,仅用0.016%参数量就提升性能,为轻量化推理增强开辟新路径。
2025 上半年具身智能融资复盘:金额超 200 亿、头部收敛趋势明显、传统制造业巨头增多
2025上半年具身智能融资火热,截至7月16日融资事件130件,预估总融资超200亿。资本从大模型转向具身智能,且向头部企业聚拢,大厂与传统制造巨头积极投资,不过行业仍处早期,上市前景待察。
API7.ai创始人温铭:烧了几百亿Token,我用AI重写了生产级网关,总结出6条经验
API7.ai创始人温铭分享用AI重写生产级网关经验。他认为AI编码能力超资深工程师,瓶颈在人。还介绍在公司‘禁手写代码’的情况,以及AI代码审查、使用阶段等内容,最后说明重写AI网关AISIX的原因。
李飞飞World Labs双模齐发,能「造」超复杂大场景,一手实测
李飞飞的 World Labs 推出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 能生成更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。
14岁CEO自曝真相!硅谷热捧「神童」,但一分钱都不敢给
年仅14岁的澳大利亚少年Alby Churven勇闯YC,创办前端公司Clovr和游戏化学习平台Finkel。他分享创业经历,认为青少年创业优势是时间多、无经济压力,但也因年龄缺乏可信度,融资难。还有15岁少年Bilal Bakr也做出两个项目。
对标GPT-4o和香蕉!浙大开源ContextGen:布局身份协同新SOTA
浙江大学ReLER团队开源ContextGen框架,攻克多实例图像生成中布局与身份协同控制难题。基于Diffusion Transformer架构,用双重注意力机制实现布局精准锚定与身份高保真隔离,在基准测试中超越开源SOTA模型,对标GPT - 4o等闭源系统。