TigerBot 是一个多语言多任务的大规模语言模型(LLM)。根据 OpenAI InstructGPT 论文在公开 NLP 数据集上的自动评测,TigerBot-7B 达到 OpenAI 同样大小模型的综合表现的 96%,并且这只是我们的 MVP,在此我们将如下探索成果开源:
- 模型: TigerBot-7B, TigerBot-7B-base,TigerBot-180B (research version)
- 代码: 基本训练和推理代码,包括双卡推理 180B 模型的量化和推理代码
- 数据: 预训练 100G,从 2TB 过滤后的数据中经过去噪去重清洗而得;监督微调 1G 或 100 万条数据,按比例涵盖用户指令常见的 10 大类 120 小类任务
- API: chat, plugin, finetune, 让用户能在半小时内无代码的训练和使用专属于自己的大模型和数据
- 领域数据: 涵盖金融,法律,百科,广邀大模型应用开发者,一起打造中国的世界级的应用
我们在 BLOOM 基础上,在模型架构和算法上做了如下优化:
- 指令完成监督微调的创新算法以获得更好的可学习型(learnability)
- 运用 ensemble 和 probabilistic modeling 的方法实现更可控的事实性(factuality)和创造性(generativeness)
- 在并行训练上,我们突破了 deep-speed 等主流框架中若干内存和通信问题,使得在千卡环境下数月无间断
- 对中文语言的更不规则的分布,从 tokenizer 到训练算法上做了更适合的算法优化
上月数据概览
月访问量 | 4.75亿 | 对比上月 | -5.57% | 月PV | 28.97亿 |
---|---|---|---|---|---|
平均访问时长 | 394秒 | 跳出率 | 36.20% | 人均访问页面数 | 6 |
月活 | 1.19亿 | 月活(去重) | 9189.46万 | 人均访问次数 | 4.00 |
热门国家/地区访客分布
国家 | 流量占比 | 月访问量 | 人均访问时长 | 人均访问页数 | 跳出率 |
---|---|---|---|---|---|
洪都拉斯 | 1.45% | -33.75% | 283秒 | 3 | 32.22% |
亚美尼亚 | 0.65% | 0.00% | 0秒 | 1 | 100.00% |
黑山 | 8.30% | 2426.39% | 892秒 | 4 | 27.82% |
南非 | 6.42% | -89.63% | 0秒 | 1 | 22.76% |
捷克 | 5.51% | 19.12% | 14秒 | 1 | 63.58% |
你可能还喜欢

腾讯混元
腾讯混元大模型是由腾讯研发的大语言模型,具备跨领域知识和自然语言理解能力,实现基于人机自然语言对话的方式,理解用户指令并执行任务,帮助用户实现人获取信息,知识和灵感。

DeepSeek
DeepSeek-V3 在推理速度上相较历史模型有了大幅提升。
SoraWebui
基于Sora模型的开源视频生成平台,轻松创作高质量视频。

DeepChat
DeepChat 是一款智能 AI 助手,与 DeepSeek 默契配合,为您带来强大而友好的 AI 体验。

RooCode
RooCode(原名 Roo Cline)是一个运行在VS Code中的扩展,基于AI技术,能够理解自然语言指令,执行复杂的开发任务。它通过与多种AI模型(包括OpenAI、Google Gemini、DeepSeek R1、Anthropic等)集成,提供从代码生成到系统架构

Kortix Suna
Suna 是一个完全开源的 AI 助理平台,通过自然语言对话与用户交互,协助完成研究、数据分析、文件管理、自动化流程等任务。与传统的 AI 模型不同,Suna 更像一个通用的代理(Agent),能够集成多种工具和 API,执行复杂的多步骤任务。网站的核心目标是提供一个灵活

模力方舟(Gitee AI)
模力方舟(Gitee AI)是由 Gitee(码云)推出的一站式 AI 模型服务平台,隶属于开源中国(OSCHINA),致力于为开发者提供 AI 模型的体验、推理、训练、部署和应用的全流程支持。

Llama官网
Llama.com 是 Meta(原 Facebook)推出的官方平台,旨在展示和推广其开源大型语言模型系列 LLaMA(Large Language Model Meta AI)。这些模型广泛应用于自然语言处理、图像理解、代码生成等多个领域。

Onlook
Onlook 是一个开源的、本地优先的视觉编辑工具,专为开发者和设计师打造,旨在帮助用户直接在运行中的 React 应用上进行界面设计,并将更改实时写入代码库。

AIGCPanel | 开源AI数字人系统
AIGCPanel 是一个功能强大且用户友好的开源 AI 数字人系统,通过视频合成、语音合成、语音克隆和本地模型管理等功能,为用户提供高效便捷的数字人创作体验。其跨平台支持、多语言界面和一键操作设计使其适合从初学者到专业开发者的广泛用户群体。无论是用于商业内容创作还是个人创意项目,AIGCPanel 都是一个值得尝试的工具。

DeerFlow
https://deerflow.tech/ 是 DeerFlow 项目的官方网站,展示了一个强大的开源研究框架,集成了语言模型、网络搜索、代码执行和内容生成工具。其主要功能包括多智能体协作、动态任务迭代、多种输出形式(如报告、PPT、播客)以及人机交互支持。适用于学术研究、技术开发和内容创作等场景,用户可通过网站了解详情并访问 GitHub 仓库进行部署和使用。