Amazon Bedrock 托管 Llama 3 8B&70B

Amazon Bedrock 托管 Llama 3 8B&70B,先来体验:(*实验环境账号有效期为1天,到期自动关停,请注意重要数据保护)

https://dev.amazoncloud.cn/experience/cloudlab?id=65fd86c7ca2a0d291be26068\&visitfrom=cloudblogger\&sc_medium=owned\&sc_campaign=cloudlab\&sc_channel=cloudblogger

自从Meta开源了Llama之后,现在网上几乎都是超越GPT的言论,除了各种托管平台以及开源自建之外,还有朋友在Obsidian里用上了这个:

本想着在Linux上部署一套的,后来发现Bedrock托管了这个大模型,这样我们就可以用极低的成本来运行这个了。

Github链接:

https://github.com/meta-llama/llama

Amazon Bedrock 托管 Llama 3 界面如下:

看起来知识库更新到22年12月,期待日后meta多多更新数据。

相关推荐
牛马工作号2 天前
RK3588 使用 rk-llama.cpp + RKNPU2 部署 Qwen3.5:从零开始的 NPU 本地大模型实战
人工智能·语言模型·llama
书源丶2 天前
Qwen3-Embedding-0.6B 纯 CPU
网络·语言模型·embedding·llama
论文复现现场3 天前
Llama/Qwen 70B 部署需要几张 RTX 4090?2卡、4卡、8卡显存、量化与 vLLM 选型
llama·qwen·vllm·大模型推理·大模型部署·rtx4090
谢白羽4 天前
在4×B300用SGLang部署DeepSeek-V4.1 Flash优化实录
笔记·python·llm·llama·sglang
renzao_ai7 天前
本地 35B 大模型部署实战:Ollama 跑 Ornith-35B 全流程
python·llama·免费ai大模型
Είναι η κοπέλα7 天前
本地大模型部署完全指南:Ollama / vLLM / llama.cpp / MLX 四大引擎横评与选型实战
macos·llama·vllm
小饕7 天前
RK3588 NPU 跑大模型实测:rknn-llm 解码 25.9 tok/s,是 llama.cpp 的 4 倍!附三天完整踩坑记录
人工智能·机器人·llama
一航jason7 天前
Android平台推理框架及试用场景模型对比
android·人工智能·ai·架构·ai编程·llama
一航jason7 天前
Android 端侧大模型推理框架对比
android·人工智能·ai·ai编程·llama·ai-native
零依赖极客8 天前
Day 8·1 自注意力机制:Q·K^T/softmax/V的在线计算
c语言·arm开发·人工智能·llama