全部 ♥ 收藏 36氪 - AI Anthropic Research Google AI Blog HackerNews Best Hugging Face Blog LangChain Blog Lilian Weng's Blog MIT Tech Review - AI OpenAI Blog The Verge - AI 机器之心 李沐 稚晖君 量子位
Hugging Face Blog ★★★★☆ 2026-06-30

ScarfBench:面向企业级 Java 框架迁移的 AI Agent 基准测试

推荐理由:聚焦 AI Agent 在真实企业开发场景中的能力评测,契合 AI 编程与模型评测主题

ScarfBench 是一个专门评估 AI Agent 在企业级 Java 框架迁移任务中表现的基准测试平台,涵盖 Spring Boot、Jakarta EE 等主流框架,提供自动化迁移、代码修复和兼容性验证等评测维度。

Hugging Face Blog ★★★★☆ 2026-06-26

一行命令在 Hugging Face Jobs 上运行 vLLM 服务器

推荐理由:实用的 AI 模型部署技巧,涉及热门推理框架 vLLM 和 HF 平台

本文介绍如何使用一行命令在 Hugging Face Jobs 上快速部署 vLLM 推理服务器,简化大模型服务上线流程,适合开发者快速测试和部署高性能 LLM 服务。

Hugging Face Blog ★★★☆☆ 2026-06-25

Which tokens does a hybrid model predict better?

推荐理由:涉及AI模型架构与性能评测,契合模型评测兴趣点

文章探讨混合模型(如结合稠密与稀疏架构)在不同token类型上的预测表现差异,分析其在语言建模任务中的优势与局限。

Hugging Face Blog ★★★☆☆ 2026-06-23

在 Transformers.js 中试验提议的跨域存储 API

推荐理由:涉及热门 AI 工具库 Transformers.js 的新功能实验

文章探讨了在 Transformers.js 中尝试使用新的跨域存储 API,以提升浏览器中 AI 模型加载和缓存效率,优化本地运行体验。

Hugging Face Blog ★★★★☆ 2026-06-22

我们让本地模型免费对 OpenClaw 仓库进行分类整理!

推荐理由:展示本地AI模型在代码维护中的实用技巧,契合AI辅助编程主题

作者利用本地运行的AI模型(如Llama 3.1)结合MCP协议和开源工具,自动分析GitHub仓库OpenClaw的问题和PR,实现零成本智能分诊,提升开源项目维护效率。

Hugging Face Blog ★★★★☆ 2026-06-18

MosaicLeaks:你的研究智能体能保守秘密吗?

推荐理由:涉及AI智能体安全性与隐私评测,属AI模型服务评测范畴

文章介绍MosaicLeaks,一个评估AI研究智能体在处理敏感信息时保密能力的新基准,测试其是否会泄露提示中的私密数据。

Hugging Face Blog ★★★★☆ 2026-06-18

超越LoRA:你能击败最受欢迎的微调技术吗?

推荐理由:涉及AI模型微调技术进展与评测,契合模型优化方向

文章探讨了LoRA(低秩适应)之外的新型大模型微调方法,对比其在性能、效率和资源消耗上的表现,评估是否能超越当前主流技术。

Hugging Face Blog ★★★★☆ 2026-06-17

MolmoMotion:语言引导的3D动作预测

推荐理由:涉及多模态AI模型新应用,属AI模型发布及商业化场景

MolmoMotion是一个新型AI模型,可根据自然语言指令预测未来3D人体动作,在人机交互、虚拟现实等领域有应用潜力。

Hugging Face Blog ★★★★☆ 2026-06-17

GLM-5.2:专为长周期任务打造

推荐理由:新版本大模型发布,聚焦AI编程与智能体应用

智谱AI发布GLM-5.2大模型,重点优化长周期复杂任务处理能力,支持更长上下文推理与多步骤规划,在代码生成、智能体协作等场景表现突出。

Hugging Face Blog ★★★★☆ 2026-06-17

智能体资源发现:让智能体自主搜索

推荐理由:涉及AI智能体与工具调用能力,契合MCP skill与AI编程趋势

文章介绍了一种名为“Agentic Resource Discovery”的新方法,允许AI智能体在执行任务时主动搜索和调用外部工具或API,提升其自主性和实用性。

Hugging Face Blog ★★★★☆ 2026-06-12

olmo-eval:一个用于模型开发循环的评估工作台

推荐理由:提供实用的开源评估框架,助力AI模型开发与调优

olmo-eval 是一个专为大模型开发流程设计的评估工具,支持快速迭代、多任务基准测试和结果可视化,帮助开发者高效优化模型性能。

← 上一页 3 / 39 下一页 →