「HY-1.8B-2Bit」共找到 2160 篇相关文章
你还在关注大模型排名?这家公司已在全球收割AI红利,做“真正能交付结果的”Super Agents
文章借昆仑万维财报,探讨AI商业化进程。该公司战略重视AIGC,有全面业务场景。其发布的天工超级智能体解决行业痛点,上线APP拓展办公场景。财报显示营收增长,AI业务成引擎,为行业提供借鉴。
技多不压身,那龙虾的 Skill 是越多越好吗?
作者结合学术研究和自身经验探讨小龙虾装Skill问题。研究表明Skill并非越多越好,装多效果变差,还给出合适数量区间。同时分享用好Skill的经验,如按需安装、合理增减拆分等。
GPT-5.3 Instant上线:ChatGPT终于不说教了
3月4日OpenAI更新GPT - 5.3 Instant,它重点优化为更准确、少尴尬,情商更高废话更少,联网搜索和写作能力增强,幻觉率降低。还提到GPT - 5.4已泄露,功能强大且将很快到来。
AI Agent搞定世纪首次菲尔兹奖成果形式化!一周时间独立完成,20万行代码已公开
Math公司的AI Gauss用5天完成原本需6个月的菲尔兹奖级数学成果形式化证明,一周搞定24维情形,还修正原论文错误。其创始人是xAI联合创始人Christian Szegedy,代码已公开。
全球首个 IPO 大模型公司出现!智谱携 500 亿估值开启招股、70% 募资投研发,1 月 8 日登陆港股
12月30日,智谱华章启动港股IPO招股,预计1月5日结束,1月8日挂牌。以每股116.20港元计,募资约43亿港元,市值超511亿港元。70%募资用于大模型研发,还引入多家基石投资者。
Paper2Page: 让每一篇论文都能“自己长出”一个项目主页
AI领域论文众多,研究者难让工作脱颖而出,精美项目主页很重要但制作繁琐。AutoPage是多智能体协作框架,能将论文一键转为项目主页,经三步协作,在速度、成本、质量等方面表现出色,代码已开源。
扩散语言模型九倍推理加速!上海交大:KV Cache并非自回归模型的专属技巧
上海交通大学EPIC Lab团队提出免训练推理缓存机制dLLM - Cache,复用特征降低计算量。它即插即用,通用于主流dLLM架构,在多个基准测试中实现数倍推理加速,且不降低生成质量。
OpenAI深夜开源HealthBench,60个国家合力开发5000段真实对话
今天凌晨1点30,OpenAI开源医疗大模型测试评估集HealthBench。其5000段核心测试对话由60个国家/地区的262名医生打造,采用多轮对话测试。测试显示大模型在医疗保健领域表现显著提升,还介绍了其构建及评估等情况。
Opus 5写代码全对,但说话让人想打人。
A社近日状况不断,Claude max 20x被免费薅,share链接隐私信息泄露,拥抱开源组织只剩Anthropic未签字。周五发布的Opus 5写代码出色,但说话啰嗦、判断力焦虑,值得细品。
18 岁创业者用 OpenClaw 管 16 个 AI Agent,一个人的 Agent 公司怎么运转
18岁无编程背景创业者用OpenClaw搭建多Agent协作平台,16个Agent分工明确,配合Claude、GLM等工具提升生产力。他分享工作流搭建、成本、模型选择等经验,还谈了对OpenClaw发展的看法。