OpenAI 开发者大会速览:GPTs 和模型 API

OpenAI 开发者大会速览:GPTs 和模型 API
GPT-4 Turbo模型,128k上下文窗口、GPT商店、Agent工具、API提速降价、更多的API开放… 详细内容: 1. **GPT-4 Turbo模型**: - **能力**:比前一代GPT-4更强大。 - **知识更新**:知识覆盖到2023年4月的世界事件。 - **上下文窗口**:拥有128k的上下文窗口,能够处理相当于300多页文本的内容。 - **性能优化**:性能得到优化,价格降低,输入令牌价格降低3倍,输出令牌价格降低2倍。 2. **新的助手API(Assistants API)**: - **目的**:帮助开发者构建具有目标的辅助...

15小时、几千元训完中文版LLaMA2!低成本方案全面开源,支持商用

15小时、几千元训完中文版LLaMA2!低成本方案全面开源,支持商用
训练大模型,几千块就能实现了! 现在, 15小时、几千块钱、85亿 token数据 ,即可训出中文LLaMA2。 综合性能达到开源社区同规模从头预训练SOTA模型水平。 方案 完全开源 ,包括全套训练流程、代码及权重。 而且 无商业限制 ,还可迁移应用到任意垂类领域和从头预训练大模型的低成本构建。 要知道,从头预训练大模型此前被戏称“要5000万美元才能入局”,让许多开发者和中小企业都望而却步。 这一回 Colossal-LLaMA-2 ,把大模型门槛打下来了。 ChatGPT正式联网,能给出答案出处[/caption] 同时开源团队还提供了一个完整的 评估体系框架ColossalEval ...

GPTBots简介

GPTBots简介
-- 为您的业务量身定制 AI Bot 应用 GPTBots.ai 将 LLM 与企业数据、服务能力无缝连接,高效构建 AI Bot 服务。可轻松将 AI Bot能力深度融合到企业实际业务中,让 AI 驱动业务增长和效率提升。 《GPTBots产品框架》 GPTBots.ai 产品具有以下优势和特点: LLMs 支持开箱即用主流商业大模型,支持接入开源大模型和私有化部署服务 无需再购入巨大精力在 LLM 部署、微调等工作,让开发者更专注企业核心业务 无论商业或开源模型,都可以基于知识库数据、用户对话数据快速生成模型微调所需数据用于模型微调 知识库 支持doc/docx、pdf...

LLMs 中 CoT、ToT 解决复杂逻辑问题

LLMs 中 CoT、ToT 解决复杂逻辑问题
目前大语言模型在日常交流对话中,展现出强大的能力,但是如果遇到一些复杂提问,如解决24点游戏问题等需要具备逻辑思维较为密集的场景,往往LLMs 表现能力不佳,那么今天就介绍一下LLMs 中解决这类思维较为密集问题的技术CoT,ToT 技术。作者翻看全网对ToT 技术的讲解,发现没有一篇将所有涉及到的重点讲清楚,现在我将深入对ToT 思想论文《Tree of Thoughts: Deliberate Problem Solving with Large Language Models》进行深入讲解。希望大家喜欢。 注意:前面文章较多的介绍了模型架构,Transformer, MoE 等技术,这些...

chatgpt的涌现

chatgpt的涌现
来源: 木遥 [木遥 ]() 2023-02-24 展开讲讲一些关于大语言模型的理解的问题在哪里。 这些评论通常归结为这句话:大语言模型「只不过是把语料中的统计相关性复现出来而已。」但这句话是错的,其错误程度就像是在 AlphaGo 出现的时候说「AlphaGo 只不过是在背诵它见过的棋谱而已」一样。 很多人对大语言模型(或者更一般地说,大神经网络)的理解还停留在两三年前。而过去两年里重要的两个研究方向(并不只有这两个,但它们对下面要说的事最关键)显示出它终于开始初步跳出贝叶斯的陷阱,展现出了一点通用智能的模样。这两者一是思维链条(chain of thought, CoT),二是自发性地结构...

小七姐:批量生成美食创意短语

小七姐:批量生成美食创意短语
作者:万能的小七姐(B站同名) 收到一个朋友转过来的prompt需求,这个需求比较小众,但这个prompt的生产过程算是比较经典的少样本提示和思维链提示的用法,在这先对prompt思路做一个分享: 首先来看需求 客户需要生成1000条俏皮灵动,趣味盎然,比喻精妙的和美食有关的短句子,要求文风优美,句子让人充满食欲。 客户使用这些句子的场景比较奇妙,而且不易于解释,所以我们可以换为一个更简单易于理解的场景来让GPT理解。 从思维链(CoT),到思维树(ToT),再到思维图(GoT):用LLMs解决复杂问题![/caption] 第一步:描述清楚这个prompt的需求背景: 对于独居者或者一起...

chatgpt调教:和人类相似的认知能力

chatgpt调教:和人类相似的认知能力
很多人都见过这段话吧: 这是认知心理学中关于单词和阅读的一个经典发现,叫做 typoglycemia。 我心生好奇:对 GPT 来说,满是 typo 的英文句子,它能像人一样不受影响正常读懂吗? 咱们来试一试。 我找了个错字连篇的英文版本喂给 chatgpt。它读懂了,告诉我“部分同意”,还 blabla 说了一大堆理由。 再换中文问它(我懒得自己编,为了节约点语料给后面用,就只复制了英文版本的第一句话),它还是读懂了,但竟然说不同意。 换个方法来问,它还是能读懂,但也还是坚持认为句子的意思很重要。 最后一句话。这回它竟然赞同了,而且说得比英文原文更清楚明白。(还补充说“研究表明”,你...

千亿级、数学专用,MathGPT大模型开始公测了

千亿级、数学专用,MathGPT大模型开始公测了
机器之心发布 机器之心编辑部 好未来推出数学领域千亿级大模型 MathGPT ,做好 AI 时代数学基础工作。 国内大模型市场又迎来了一个新的「选手」,这次是数学专用大模型。 8 月 24 日,机器之心获悉,在好未来 20 周年直播活动中,CTO 田密宣布好未来自研的数学领域千亿级大模型 MathGPT 开启内测。即日起,用户可通过官网(www.mathgpt.com)申请注册账号免费试用体验。 今年 5 月,好未来曾公布正在进行自研数学大模型的研发,命名为 MathGPT。MathGPT 是面向全球数学爱好者和科研机构,以解题和讲题算法为核心的数学垂直领域的大模型,也是国内首个专为数学打...

官方的Code Llama开源:免费商用,神秘版本接近GPT-4

官方的Code Llama开源:免费商用,神秘版本接近GPT-4
机器之心报道 编辑:杜伟、陈萍 GPT-4:在代码生成这块,你们依然是「弟弟」。 今日,Meta 的开源 Llama 模型家族迎来了一位新成员 —— 专攻代码生成的基础模型 Code Llama。 作为 Llama 2 的代码专用版本,Code Llama 基于特定的代码数据集在其上进一步微调训练而成。 Meta 表示,Code Llama 的开源协议与 Llama 2 一样,免费用于研究以及商用目的。 相关论文《Code Llama: Open Foundation Models for Code》已经公布,足足有 47 页,作者有 25 位。 论文地址: https://ai.me...

Midjourney AI 新手秒变高手

Midjourney AI 新手秒变高手
正文 一.通用公式 01.角色人物公式: 人物姓名(命名)+描述词(重要描述词和人物特征描述词)+风格+官方命令词。 例子:进击巨人里(特定来源)贝尔托特(人物姓名)Q版形象(重要描述词),风格是迪士尼或者皮克斯的(风格),且小巧可爱(描述)。(官方 --ar 16:9(比例) --V4 (版本格式)这里我没有加) 整理成英文: Attack on Titan,Bertolt Hoover,full body, isometric,3d, cute, Little adorable **chibi**graphics, disney pixar Style,cute mobile game s...

开源图像模型Stable Diffusion入门手册

开源图像模型Stable Diffusion入门手册
来源 腾讯程序员 [腾讯技术工程 ]() 2023-04-11 18:00 发表于广东 作者:hking Stable Diffusion 是 2022 年发布的深度学习文字到图像生成模型。它主要用于根据文字的描述产生详细图像,能够在几秒钟内创作出令人惊叹的艺术作品,本文是一篇使用入门教程。 硬件要求 建议使用不少于 16 GB 内存,并有 60GB 以上的硬盘空间。需要用到 CUDA 架构,推荐使用 N 卡。(目前已经有了对 A 卡的相关支持,但运算的速度依旧明显慢于 N 卡,参见: Install and Run on AMD GPUs · AUTOMATIC1111/stable-d...

DoctorGPT是一个大型语言模型,可以通过美国医生执照考试

DoctorGPT是一个大型语言模型,可以通过美国医生执照考试
DoctorGPT是一个大型语言模型,可以通过美国医生执照考试。这是一个开源项目,其使命是为每个人提供自己的私人医生。DoctorGPT 是 Meta 的Llama2 70 亿参数大型语言模型的一个版本,它在医疗对话数据集上进行了微调,然后使用强化学习和宪法人工智能进一步改进。 由于该模型的大小只有 3 GB,因此它适合任何本地设备,因此无需支付 API 即可使用它。它是免费的,专为离线使用而设计,可以保护患者的隐私,并且可以在 iOS、Android 和 Web 上使用。鼓励对功能添加和改进提出请求。 为了训练模型,可以在本地运行 Training.ipynb ,也可以通过 Google C...

ChatGPT 是怎么做的,为什么它有效

ChatGPT 是怎么做的,为什么它有效
、“ 介绍神经网络的基本概念和结构,讨论训练实践、技巧以及网络规模的大小对模型能力的影响。同时介绍嵌入(Embeddings)概念,将高维数据映射到低维空间。通过本文,您将对神经网络有更深入的理解,有助于后面理解 ChatGPT 是怎么做的,为什么它有效。” 01 — 神经网络 那么我们用于图像识别等任务的典型模型实际上是如何工作的呢?当前最流行且最成功的方法是使用神经网络。神经网络发明于 20 世纪 40 年代,其形式与今天的使用非常接近,可以被认为是大脑工作方式的简单理想化。 人脑中约有 1000 亿个神经元(神经细胞),每个神经元每秒能够产生高达一千次的电脉冲。神经元连接在一个复杂的网...

AGI的发展

AGI的发展
AGI的发展 人工智能的发展经历了多个阶段,从最初的符号主义到深度学习,每个阶段都有其独特的贡献和限制。AGI(Artificial General Intelligence)是人工智能领域的一个理论概念,它旨在开发能够像人类一样具有智能水平的人工智能系统。 以下是AGI的发展历程: flowchart LR subgraph AGI_Evolution A[符号主义] B[连接主义] C[深度学习] D[AGI] end A --> B B --> C C --> D ...

数据分析总纲

数据分析总纲
数据分析大纲 数据分析概述 数据分析的概念与意义 数据分析是从大规模的数据中提取有价值的信息的过程。它具有如下的意义: 描述事物的过去,解释事物现状 探索事物之间的关系,找到隐藏的模式 做出预测,评估不同决策的后果 数据分析的基本步骤 数据分析主要包括以下基本步骤: 收集相关数据 准备和清洗数据 分析和可视化数据 建立预测模型 评估模型并提出建议 数据的分类 结构化数据与非结构化数据 结构化数据是组织良好,格式固定的数据,如数据库、电子表格中的数据。非结构化数据是无固定格式的数据,如文字、图像、音频、视频等。 定量数据与定性数据 定量数据是可以计量的数值数据。定性数据是描述属性的非数...