Claude (语言模型)
Claude是由美國科技公司Anthropic開發的大型语言模型,其最新版本为Claude Fable 5、Claude Opus 5、Claude Sonnet 5與Claude Haiku 4.5。 概述 Claude是由Anthropic公司开发的基于转换器的生成式预训练模型(,GPT),该公司宣称专注于创建安全、可靠且符合人类价值观的人工智能(AI)系统。 Claude以美國信息论之父克劳德·香农()的名字命名,旨在成为友善、诚…
共 11 篇文章
Claude是由美國科技公司Anthropic開發的大型语言模型,其最新版本为Claude Fable 5、Claude Opus 5、Claude Sonnet 5與Claude Haiku 4.5。 概述 Claude是由Anthropic公司开发的基于转换器的生成式预训练模型(,GPT),该公司宣称专注于创建安全、可靠且符合人类价值观的人工智能(AI)系统。 Claude以美國信息论之父克劳德·香农()的名字命名,旨在成为友善、诚…
Kimi是由中国科技公司北京月之暗面科技有限公司(Moonshot AI)开发的生成式人工智能聊天機器人,其底层模型系列当前最新版本为Kimi K3。 概述 Kimi是由月之暗面公司开发的大语言模型驱动的智能助手,该公司宣称专注于研究将能源高效转化为智能的最优路径,致力于构建具备长文本理解、联网搜索与自主智能体(Agent)能力的人工智能系统。 Kimi以其超长上下文处理能力为核心特色,是世界上首款支持输入20万汉字的人工智能助手产品,…
阶跃星辰()是由中国人工智能公司阶跃星辰开发的大型语言模型系列,旗下涵盖文本、多模态、图像生成、视频生成与语音交互等多类模型,统称 Step 系列,其最新版本为 Step 3。 概述 阶跃星辰于2023年4月成立,总部位于上海市徐汇区,专注于大型语言模型及多模态模型的研发。公司由姜大昕创立并担任CEO,其曾任微软全球副总裁。 公司名字灵感来自阶跃函数(Step Function),总部位于上海市徐汇区。阶跃星辰的研发团队由150多名专业…
LongCat是由中国互联网公司美团开发的大型语言模型系列,涵盖语言、多模态、图像生成、视频生成与语音交互等多类模型,其最新模型为LongCat-2.0(2026年6月)。 概述 LongCat是由美团旗下LongCat团队开发的基于转换器的生成式预训练模型(,GPT)系列,专注于智能体()任务场景下的实用性与推理效率。 LongCat系列模型大多以MIT许可证开源发布,可在GitHub及Hugging Face平台获取,同时通过官网l…
{{Infobox software | title = GPTZero | logo = Header gptzero logo.svg | logo caption = | logo alt = | logo size = 200px | author = | developer = Edward Tian Alex Cui Yazan Mimi | released = | programming language = Pytho…
GPT-5.2是 OpenAI 最新的旗艦AI模型,於2025年12月11日發佈。 繼 GPT-5.1之後,它是GPT系列中的三個大型語言模型家族。它提供兩種模式:GPT-5.2 即時(instant)和 GPT-5.2 思考(thinking,包含標準和擴充思考),後者為推理模型。GPT-5.2 Pro模型於同日發佈,其推理時間和計算量均高於GPT-5.2思考模式。媒體報導稱,由於Gemini的主導地位引發了一份內部「紅色警報」(Co…
GPT-5.1是OpenAI GPT系列中的四個大型語言模型家族。其中兩個於 2025 年 11 月 12 日發佈; 另外兩個於一週後的11月19日發佈。 功能 GPT-5.1的功能擴展至文本之外,包含購物研究、多模態功能以及可自定義的人格特質(personalities)。其互動式購物工具凸顯了OpenAI對於日常實用性的追求。 它提供 8 種人格選項,使其成為OpenAI迄今為止可定制化程度最高的模型。 與GPT-5相比,它的速度更…
GPT-5.6是OpenAI开发的 GPT 系列人工智能模型家族,于2026年6月26日开始有限预览,2026年7月9日转为普遍可用。OpenAI将该系列划分为三个层级,分别是旗舰模型Sol、面向日常工作的平衡型模型Terra,以及速度和成本较低Luna。GPT-5.6在ChatGPT、Codex和OpenAI API中推出,并成为ChatGPT Work和Microsoft 365 Copilot等产品使用的模型之一。 技术背景 GP…
密涅瓦()是一個由義大利羅馬大學自然語言處理研究所(Sapienza NLP)所開發的大型語言模型,該團隊隸屬於羅馬薩皮恩扎大學,由羅伯托·納維利(Roberto Navigli)領導。此模型從零開始訓練,主要是義大利語。 這是一個用於自然語言處理任務的模型,能夠理解並生成類似人類的文本。該模型運用了深度學習技術,特別是Transformer架構,來處理和生成文本。它已在大量文本資料上進行訓練,並經過微調以執行各種語言任務,例如語言翻譯…
OpenAI o4-mini是由OpenAI開發的生成式預訓練變換模型。2025年4月16日,o4-mini模型向所有ChatGPT用戶(包括免費版用戶)以及經由聊天補全(Chat Completions)API和Responses API發佈。 此外,OpenAI還推出了o4-mini-high模型,僅供ChatGPT付費用戶使用。High模型運算速度較慢,但具有更高的推理深度(reasoning effort),以產生更準確的回答。…
BigScience 大規模開放科學與多語言開放存取模型(BLOOM) 是一個基於Transformer模型的自回歸大型語言模型(LLM),具有1760億個參數。該模型與其程式碼基礎,以及訓練所用的數據,均以自由許可證形式發布。 BLOOM於2022年3月至7月間,使用約3660億(1.6TB)個語料進行訓練。 BLOOM是BigScience合作計畫的主要成果,該計畫是一個為期一年的研究工作坊,自2021年5月開始,至2022年5月結…