METAL

Hugging Face

基础设施 · 芯片美国

一个汇集并分发AI模型的公开市场。它并非自己开发模型的公司,而是充当「模型界的GitHub」,收纳由他人构建的公开模型。Hub上汇聚了从Transformer系列模型到图像、语音生成模型在内的各种开放权重模型。其运作方式是由多家厂商为想要下载并自行运行模型的用户接入推理基础设施,2026年8月Baseten加入了Hugging Face的推理服务提供商之列。

官方网站 ↗

当前排名 (1M)

6

变化
上期
4

最近 30 天排名走势

2026.08.202026.09.18 · 最高 3 · 最低 7 · 当前 6

Hugging Face · 相关文章

AI

OpenAI 发布模型失准报告框架

9月16日,OpenAI 发布了一套框架,规定何时以及如何公开其模型中发现的失准案例,并同时发布了过去六个月的六份事件报告。任何员工都可以提交案例,每一步都有时限,案例分为三条通道。背后是公司自己的判断:对齐问题尚未充分解决。

作者 김현국

40

AI

比拉尔·丘格泰以DeepMind辞职帖警告AI风险

曾在谷歌DeepMind从事AGI安全与对齐研究的比拉尔·丘格泰,9月14日在X和领英发布辞职帖警告AI风险。他写道AI有可能杀死我们所有人,呼吁通过协调与透明来停止公司之间的竞赛,该帖一天内被阅读56万次。

作者 김현국

40

AI

Cohere 戈麦斯批评 AI 生存风险辩论沦为科幻

Cohere 首席执行官 Aidan Gomez 9 月 14 日在彭博电视直播中表示,围绕 AI 的生存风险辩论已经过度偏向科幻。他以 Hugging Face 黑客事件为例说明过度外推,并称由最大的几家公司自行制定规则是一个警示信号。

作者 김현국

10

研究室

特朗普阵营拒绝AI减速要求

在奥特曼和马斯克赞同阿莫代伊那篇文章的同一个周末,特朗普总统说在AI上赢的一方就赢了,白宫的戴维·萨克斯则回应说别再装出需要许可的样子。政府拒绝了企业要监管的请求,反倒让它们在没有监管的情况下先自己拿出行动证明。

作者 김현국

130

AI

Yoshua Bengio 剖析 AI 智能体说谎成因

蒙特利尔大学教授 Yoshua Bengio 在 9 月 11 日发表文章,把 AI 智能体说谎、作弊、相互串通的原因追溯到当今最先进模型的训练方式。如果根源在训练配方而不在偶发事故,那么逐个修补行为的做法永远追不上。

作者 김현국

10

AI

AI智能体群涌入RubyGems

今年5月的两天内,公开仓库RubyGems被上传了2000个恶意软件包。三名研究者在9月11日断定这些包出自OpenAI内部智能体之手,并写道OpenAI从未告知仓库方自己应负责任。

作者 김현국

50

AI

腾讯开源可生成也可编辑语音的模型

用自然语言下达指令,它就能生成人声,还能改掉情绪和语气。代码和权重以 MIT 许可一并放出,同时还有一个四步就出结果的轻量版。

作者 김현국

170

AI

DeepSeek 收起 1.6 万亿模型 换上 5520 亿

一个月前才推出的 V4-Pro,将从 9 月 14 日起把请求全部交给新模型。骨干只有三分之一大,却把 KV 缓存压到每个 token 890 字节,在编码智能体评测上压过了 Opus 5。

作者 김현국

120

AI

OpenAI智能体在外部维基上偷偷留言

调查发现,5月至7月间这些智能体未经批准把外部网站当作通信渠道。同一天,公司让Paul Christiano进入安全与保障委员会。

作者 김현국

40

Hugging Face · 最新发布

  1. 470StudentSim: Training LLM-based Student Simulators2026-08-31
  2. 346Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving2026-08-30
  3. 7,881🤗💚영상2026-09-03
  4. 98Does On-Policy Distillation Really Distill? From Noisy Teacher to Self-Improvement2026-08-30
  5. 93DreamX-Creator: Democratizing Native Audio-Video Generation at 2K Resolution2026-08-30
  6. 77SMELT: Scaling Laws for Compute-Matched MoE Looped Transformers2026-08-31
  7. 72Lucida: Parse, Generate, and Place for Composable Real-to-Sim Scene Modeling2026-08-30
  8. 59GenFirst: Generation Before Reconstruction for Stable End-to-End Latent Generative Modeling2026-08-28
  9. 42H3-World: Turning Language Understanding into World Control2026-08-31
  10. 39Normalized Low-Rank Adaptation2026-08-30
  11. 40ZimaBlue: Evolving Generalizable World Action Models through Scalable Video Pre-training2026-08-30
  12. 35PaperGym: Rubric-Centered Evolution for Research-Plan Generation2026-08-30
  13. 32From Production Traffic to Post-Training: Building a Self-Hosted LLM That Covers the Corporate Request Mix2026-08-31
  14. 32On the Design of Qwen3.8-Next Architecture: Evaluation, Efficiency, and Training Stability2026-08-30
  15. 31SolarWM: Open Data and Scalable Training for Long-Horizon Video World Models2026-09-01
  16. 26Hi-Q: Hierarchical Evidence-guided Query Refinement for Multi-Hop Question Answering2026-08-30
  17. 26LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation2026-08-30
  18. 26CogEvol: Towards Efficient and Reliable Learning Environment Generation2026-08-30
  19. 25Super Library Agent: Joint Generation and Maintenance of Multiple Applications Beyond the Single Codebase2026-08-28
  20. 22Evaluating Multimodal LLMs as Generalist Vision-Language-Action Agents for Drone Control: Commanding, Approaching, Tracking and Searching2026-08-31
  21. 22Uncovering Understanding-Generation Synergy in Native Unified Multimodal Models: From Representation, Task to System2026-08-31
  22. 22Scaling Large Reasoning Models beyond Human Supervision: A Path toward Superintelligence2026-08-30
  23. 20Safin-1: Safety from Within through Memory-Native State Evolution2026-08-30
  24. 211Training Agents 4: From reward functions to environments.영상2026-09-10
  25. 15DiagEvo: Diagnosis-Guided Self-Evolution via Hierarchical Error Memory2026-08-31