「72B模型」共找到 8037 篇相关文章

算法论文8

0.016%参数撬动18%性能:关键表征微调破解LLM推理瓶颈

大语言模型在推理任务依赖思维链技术,传统PEFT方法需修改大量参数,新兴ReFT虽只需调整少量参数,但存在不足。本文提出CRFT,仅用0.016%参数量就提升性能,为轻量化推理增强开辟新路径。

深度学习自然语言处理
新闻资讯7

2025 上半年具身智能融资复盘:金额超 200 亿、头部收敛趋势明显、传统制造业巨头增多

2025上半年具身智能融资火热,截至7月16日融资事件130件,预估总融资超200亿。资本从大模型转向具身智能,且向头部企业聚拢,大厂与传统制造巨头积极投资,不过行业仍处早期,上市前景待察。

AI科技评论
新闻资讯8

“我可能不再建议学计算机”!图灵奖得主炮轰半个行业,并断言:AI Agent最后全是数据库问题

图灵奖得主 Mike Stonebraker 在访谈中称,若重新开始,不确定是否建议 18 岁的人学计算机,他认为计算机科学未来或不再是增长型行业。他还炮轰 Oracle、Google、AWS 等公司的数据库方案,对 AI Agent、大模型写 SQL 等发表看法。

InfoQ
产品应用7

李飞飞World Labs双模齐发,能「造」超复杂大场景,一手实测

李飞飞的 World Labs 推出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 能生成更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。

机器之心
推荐文章8

退隐3年后回归,周末写的AI一夜刷屏、一周拿下10万Star增速超Linux,Clawdbot之父首次长谈:如今几乎不看自己发布的代码

本文是对OpenClaw开发者Peter Steinberger的深度专访。他曾打造PSPDFKit,隐退三年后回归,用大模型工具开发出OpenClaw。他分享了开发历程、工作方式,探讨AI对编程的影响,还指出大公司采用AI的难点及对开发者的建议。

AI科技大本营
开源动态8

对标GPT-4o和香蕉!浙大开源ContextGen:布局身份协同新SOTA

浙江大学ReLER团队开源ContextGen框架,攻克多实例图像生成中布局与身份协同控制难题。基于Diffusion Transformer架构,用双重注意力机制实现布局精准锚定与身份高保真隔离,在基准测试中超越开源SOTA模型,对标GPT - 4o等闭源系统。

新智元
新闻资讯7

阿里的未来,是通往超级人工智能

云栖大会上,阿里巴巴 CEO 吴泳铭演讲传达阿里对 AI 发展判断与战略规划。他认为 AGI 非终点,ASI 是目标,并提出实现三阶段。还指出阿里抓住大模型和 AI Cloud 支点,要把通义千问打造成 AI 时代 Android 系统。

特工宇宙
产品应用7

马斯克脑机接口团队成员出走,他们想把“清醒梦”变成消费电子产品

Prophetic AI是一家致力于研发非侵入式头带以诱导清醒梦的初创公司。其核心设备The Halo通过经颅超声刺激实现神经调节,还发布了大模型Morpheus - 1诱导并稳定清醒梦,但此方法论引发了诸多争议。

DeepTech深科技
新闻资讯8

专访中科第五纪黄岩:在具身智能的狂热中,做一位技术实干家

机器之心专访中科第五纪黄岩,他在具身智能狂热中是技术实干家。其有学术和工业界双重身份,技术覆盖多领域。团队解决行业数据利用瓶颈,推出超少样本大模型等成果,在商业落地表现出色。

机器之心
推荐文章8

吴恩达年终总结:2025是AI工业时代的黎明

吴恩达发表2025人工智能年度总结与公开信。总结指出,今年推理模型性能提升但有成本,AI人才争夺激烈、薪酬高,数据中心建设投入大,智能体让编程更高效。信中建议通过学课程、动手实践和读论文构建AI系统。

机器之心