大厂工作」共找到 5869 篇相关文章

算法论文7

真钱买假模型?187篇论文被「套壳API」坑惨,准确率暴跌

CISPA论文指出,第三方影子API可能用廉价替代品替换前沿模型。研究追踪17个服务,发现已被187篇论文引用。测试显示,影子API在多领域性能差,安全不可控,供应商有三种欺骗手段。

机器之心
算法论文8

治好多模态近视和走神!上海学去偏干预显著提升模型性能

多模态模型存在“近视”和“走神”问题,总是过度关注图像底部而忽略核心内容。上海学与南开学研究团队用两条数学公式去偏干预,无需增加计算成本,却能显著提升主流模型视觉理解能力。

AIGC开放社区
算法论文8

重复一下提示词,Gemini准确率竟从21%飙升至97%!

Google Research团队研究发现,重复提示词可让Gemini准确率从21.33%升至97.33%。该策略能提升主流模型非推理任务表现,在多模型多基准测试中优势明显,且不增加延迟。

AIGC开放社区
新闻资讯8

2026开年最该来的AI神仙局,就在崇礼太舞小镇|甲子光年

2026年1月23日至25日,2026崇礼论坛将在张家口市崇礼区太舞小镇举行。俞敏洪、周鸿祎等咖将齐聚,开幕式揭秘行业底牌,还有四专场分享,场外也有精彩活动,为AI创业者提供指引。

甲子光年
算法论文8

谷歌DeepMind最新论文,刚刚登上了Nature!揭秘IMO最强数学模型

谷歌DeepMind的AlphaProof在IMO获接近金牌的银牌成绩。它结合模型直觉、强化学习和Lean形式化证明解题,虽在速度、泛化和读题上有局限,但开启了人类数学家与AI协作新阶段。

新智元
算法论文8

6666!NuerIPS满分论文来了

NuerIPS唯一满分论文结论惊人,指出真正决定推理上限的是基座模型本身而非强化学习,且蒸馏比强化学习更有望实现模型自我进化,这给正火热的RLVR泼了冷水。

量子位
开源动态7

Distilabel DeepSeek-R1 模型蒸馏教程

文章介绍结合distilabel与QLoRA技术定制专属模型的路径。先用distilabel框架利用DeepSeek - R1生成医疗指令数据集,再用QLoRA技术微调Qwen3 - 4B模型,还给出实战路线图和代码示例。

机器学习AI算法工程
新闻资讯7

OpenAI 离职员工爆料公司压力巨发展速度惊人

前OpenAI员工Calvin回顾工作经历,称其发展极快、压力。公司依赖Slack沟通,自下而上创新,重能力而非政治。还提到技术栈、安全关注重点等,认为OpenAI、Anthropic和Google是AGI赛道主力。

MacTalk
新闻资讯8

陶哲轩痛诉很缺钱!科研经费暴跌67%十年最低,自掏腰包科研

美国国家科学基金会削减基础科学资助,数学科学领域资助降。菲尔兹奖得主陶哲轩痛诉经费不足,自掏腰包做科研,还以“开普勒的橙子”说明基础研究虽短期无用,却能助力科技突破。

新智元
新闻资讯7

抱抱脸要卖了:估值超 130 亿美元

Business Insider称,Hugging Face(抱抱脸)正找买家,估值超130亿美元,公司未回应。它从聊天App转型成模型市场,虽没自研模型,但汇聚众多模型。目前出售有多种可能走向。

AGI Hunt