跳到正文

全部动态

今日 33 条
6月20日周四
6月19日周三
6月18日周二
6月17日周一
6月13日周四
6月12日周三
6月10日周一
6月8日周六
6月7日周五
6月6日周四
6月5日周三
6月4日周二
5月30日周四
5月29日周三
  1. Mistral AI78

    Mistral 发布首款代码模型 Codestral,22B 开放权重、支持 80+ 编程语言

    Mistral AI 发布首款代码模型 Codestral,这是一个 22B 开放权重生成式模型,训练数据覆盖 80+ 编程语言,上下文窗口 32k,可通过指令与补全 API 端点使用。

    推荐理由:Mistral 首款代码模型给出 22B 开放权重、32k 上下文和 80+ 语言支持,可对照其与既有代码模型的定位差异。

  2. Mistral AI62

    Mistral AI 推出非生产许可证 MNPL,Codestral 率先采用

    Mistral AI 发布非生产许可证 MNPL,允许开发者将技术用于非商业用途并支持研究工作,Codestral 于同日在该许可证下发布。Mistral 表示会继续以 Apache 2.0 发布模型和代码,并逐步整合 Apache 2.0 与 MNPL 两条产品线。该许可证要求基于其成果开展商业业务的开发者以公平可持续的方式与各方合作。

    推荐理由:Mistral 推出非生产许可证,读者可据此理解开源模型商业授权收紧对开发者使用边界的影响。

  3. Hugging Face Blog34

    Hugging Face 如何用 TGI Benchmarking 工具评测文本生成推理

    Hugging Face 发布博客介绍 Text Generation Inference(TGI)配套的 TGI Benchmarking 工具,可在 Hugging Face Space 中部署模型并通过 CLI 运行,同时测量吞吐量与延迟。该工具提供 pre-fill 统计与直方图、吞吐量对延迟散点图,并按 batch size 展示结果,帮助用户在 TTFT 与吞吐之间权衡调优部署。

5月28日周二
5月24日周五
  1. Hugging Face Blog38

    Meta 发布 CyberSecEval 2:面向大语言模型网络安全风险与能力的综合评测框架

    Meta 发布 CyberSecEval 2,从代码不安全实践、提示词注入、网络攻击协助、代码解释器滥用和自动化攻击能力五个维度评测 LLM 的网络安全风险。相比 2023 年 12 月的首版,LLM 协助网络攻击的平均合规率从 52% 降至 28%。提示词注入仍是未解难题,代码解释器滥用风险突出,评测代码已全部开源。

5月22日周三
5月21日周二