DeepSeek 1.5B」共找到 4047 篇相关文章

新闻资讯7

AI顶会反噬整个学术圈!「不发表就会死」,NeurIPS爆仓,博士年肝4.5篇大崩溃

NUS研究者指出,NeurIPS等AI顶会投稿量激增,正反噬学术圈。当前模式存在结构性危机,如学术产出泡沫化、环境代价高、研究者心理负荷大等。为此,他们提出“社区联邦会议”(CFC)模型以解决问题。

新智元
8

库克清空弹夹!2nm,韬定律,最强AI电脑

库克退休前火力全开,苹果发布首款2nm制程芯片M6和最强M系芯片M5 Ultra,塞进新款Mac。M6让Mac mini AI性能暴涨,M5 Ultra性能强悍,能跑大模型。但因内存短缺,高内存版限购且供货晚,价格也涨了。

量子位
新闻资讯7

阿里千问大模型换将,32岁林俊旸官宣告别

阿里巴巴高级算法专家、通义千问大模型负责人林俊旸宣布告别千问团队,此前一晚千问团队刚推出Qwen3.5轻量化模型且获马斯克点赞。此外,Qwen3.5核心贡献者Kaixin Li和通义实验室科学家Binyuan Hui也发文告别,几人去向未明。

量子位
新闻资讯7

承认自己开源不行?转型“美国DeepSeek”后,两个谷歌研究员的AI初创公司融到20亿美元,估值暴涨15倍!

AI创业公司Reflection AI由两位前Google DeepMind研究员创立,仅一年就完成20亿美元融资,估值达80亿美元。它从编程领域起步,推出代码理解智能体Asimov,现转型为开源替代公司,要打造开放模型。

InfoQ
产品应用8

消费级具身智能跨越式新品:算力提升1000倍,对标英伟达Jetson Thor芯片,成本仅1/10!

蔚蓝科技发布新款机器狗 BabyAlpha A3,算力提升 1000 倍,对标英伟达 Jetson AGX Thor T5000 芯片,成本仅 1/10。它采用国产芯片,具身智能边缘端混合异构计算集群,感知超人类,实现全自主智能。

机器之心
算法论文8

都在卷「让大模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了

一项新研究表明,7B小模型LoopCoder v2在正常计算外多循环一次,就能在SWE - bench Verified基准上大幅提分。继续增加循环次数,性能反而下降。研究还算了‘收益 - 成本’账,给出选择循环次数的诊断方法。

AIGC开放社区
新闻资讯7

用印度程序员冒充 AI 的“独角兽”彻底倒闭了!伪 AI 烧光 5 亿美元,连微软和亚马逊都被“坑”了

英国 AI 初创公司 Builder.ai 正式破产,曾获微软等支持,估值近 10 亿美元。其宣称用 AI 构建应用,实际靠大量人力,还压榨开发者。此外,不少创业公司也用“人扮 AI”换融资,最终坑了投资人和用户。

InfoQ
产品应用8

对话原力灵机周而进:模型2.4B就够用,关键是“具身原生”;能闭环才是最高效方法

原力灵机推出首个具身原生模型产品DM0,仅2.4B参数,却能支撑实时处理画面与真机进化。其合伙人周而进称要走具身原生路线,还介绍了数据采集、模型训练等多方面内容及公司发展规划。

量子位
开源动态8

全新OCR将图片变代码无损重绘!华中科大&小红书发布3B模型,图形重建超越Gemini 3 Pro

华中科技大学与小红书联合推出MOCR,提出「解析一切」新范式,将文档图形升级为「一等解析目标」。它解决传统OCR短板,在文档解析和图形重建表现出色,还革新评估方法,代码和模型已开源。

量子位
算法论文8

10秒视频token超5万,O(n²)跑不动?用后训练线性化框架实现1.71倍加速,推理成本大降|CVPR'2026

视频生成进入大规模时代,但计算成本高,自注意力复杂度O(n²)跑不动。研究团队提出LINVIDEO后训练框架,无需数据和重新预训练,实现视频扩散模型线性化替换,保持生成质量,加速推理并降低成本。

量子位