有监督微调」共找到 6448 篇相关文章

推荐文章7

翁荔最新博客:我们可能高估了模型,却严重低估了那层“脚手架”

前OpenAI安全研究副总裁翁荔在新博客聚焦AI领域Harness Engineering。她认为Harness是决定模型在现实任务中走多稳、多远的‘脚手架’,并梳理其演进路线,也指出研究面临评估、安全等瓶颈。

DeepTech深科技
开源动态7

Cloudflare 如何解决了 quiche 中的一个拥塞漏洞

Cloudflare 分享发现 CUBIC 的 Rust 实现问题,该问题影响开源库 quiche。团队构建模拟环境测试,发现 CUBIC 陷入恢复循环,用 Reno 测试排除广泛问题,最终一行代码修复,使测试通过率达 100%。

InfoQ
开源动态7

用 LLM Wiki 给自己搭一个会越用越值钱的第二大脑

这是基于Andrej Karpathy的LLM Wiki模式构建的开源项目,能方便实现第二大脑。上传资源后Claude会主动提取实体、建立概念网络,知识会‘自己生长’,用得越久边际价值越高。还介绍了安装及使用方法。

AI进修生
新闻资讯7

专治世界模型幻觉!ECCV 2026 Workshop征稿,Sergey出席,帝国理工等联合发起

世界模型在仿真与真实物理世界应用存在鸿沟,帝国理工等顶尖机构将在ECCV 2026举办Workshop。现征稿,截稿日2026年7月15日,还特邀报告、竞赛等活动。

量子位
产品应用7

小企业专属Claude来了!一键接入全套业务流,不用写代码AI自动算账催款

Anthropic推出Claude for Small Business,是全新连接器和工作流包,可嵌入小企业常用工具。操作简便,覆盖多领域,安全保障,还配套培训课程和线下活动。

AI寒武纪
新闻资讯7

Anthropic 联创:2028 年实现 AI 自我构建的概率超过 60%

Anthropic 联合创始人 Jack Clark 发长文称,到 2028 年底,AI 实现端到端自动化研发概率超 60%。他分析多维度测试数据,指出 AI 在代码、科研、自我训练和管理等方面能力提升,也探讨了成真后的影响,但遭黄仁勋和陶哲轩质疑。

AGI Hunt
推荐文章8

深度拆解 Hermes Agent 的记忆系统:它如何修正 OpenClaw 的误区

文章深度拆解 Hermes Agent 记忆系统,介绍其四层记忆系统,包括提示词记忆、SQLite 历史会话存档、智能体技能管理和用户建模。与 OpenClaw 对比,Hermes 更关注缓存效率,遵循冷热分离、缓存优先等原则。

宝玉AI
新闻资讯7

20岁了!劈柴哥发帖庆生:谷歌翻译换了4代AI,第一次了「呼吸感」

4月28日,Google Translate满20岁,Pichai发帖纪念,回顾其技术发展,从统计模型到神经网络,再到Gemini原生语音模型,Translate不断进化,能保留语调和节奏,虽被大模型抢风头,但仍在持续进步。

新智元
新闻资讯7

追不上就直接买,马斯克600亿美元收购Cursor

马斯克旗下SpaceX官宣600亿美元收购编程神器Cursor,虽Cursor曾陷“套壳”争议,但双方各所求。SpaceX在AI编程赛道追赶效果不佳,而Cursor受算力制约,二者一拍即合。此外,SpaceX计划上市,此时收购时机耐人寻味。

量子位
新闻资讯7

OpenAI发布新模型 GPT-Rosalind:专攻生物学、药物发现和转化医学

OpenAI发布生命科学前沿推理模型GPT - Rosalind,目标是生物学研究等领域。它是生命科学模型系列首款产品,在多方向表现强。当前以研究预览版向特定合作机构开放,意机构可申请。

AI寒武纪