Commit Graph

  • d51f15257c Update llm/ggml.go Michael Yang 2024-05-24 16:10:43 -07:00
  • 8f440d579a fix q5_0, q5_1 Michael Yang 2024-05-24 16:01:37 -07:00
  • 4cc3be3035 Move envconfig and consolidate env vars (#4608) Patrick Devine 2024-05-24 14:57:15 -07:00
  • db2ffa79f1 Fix download retry issue Tim Scheuermann 2024-05-24 20:30:42 +02:00
  • afd2b058b4 set codesign timeout to longer (#4605) Jeffrey Morgan 2024-05-23 22:46:23 -07:00
  • fd5971be0b support ollama run on Intel GPUs Wang,Zhe 2024-05-24 11:18:27 +08:00
  • 89bf98bcf2 Merge pull request #4598 from dhiltgen/docs Daniel Hiltgen 2024-05-23 15:14:29 -07:00
  • 1b2d156094 Tidy up developer guide a little Daniel Hiltgen 2024-05-23 14:24:07 -07:00
  • 714adb8bd1 bump (#4597) Michael Yang 2024-05-23 14:16:26 -07:00
  • 95b1133d0c Merge pull request #4547 from dhiltgen/load_progress Daniel Hiltgen 2024-05-23 14:06:02 -07:00
  • b37b496a12 Wire up load progress Daniel Hiltgen 2024-05-20 16:41:43 -07:00
  • d6f692ad1a Add support for IQ1_S, IQ3_S, IQ2_S, IQ4_XS. IQ4_NL (#4322) Bruce MacDonald 2024-05-23 13:21:49 -07:00
  • f77713bf1f Add isolated gpu test to troubleshooting Daniel Hiltgen 2024-05-23 09:33:25 -07:00
  • 38255d2af1 Use flash attention flag for now (#4580) v0.1.39-rc2 Jeffrey Morgan 2024-05-22 21:52:09 -07:00
  • 73630a7e85 add phi 3 medium (#4578) Michael 2024-05-22 12:53:45 -04:00
  • 955c317cab chore: update tokenizer.go (#4571) Ikko Eltociear Ashimine 2024-05-22 16:25:23 +09:00
  • 9f18b88a06 Merge pull request #4566 from ollama/jyan/shortcuts Josh 2024-05-21 22:49:36 -07:00
  • 353f83a9c7 add Ctrl + W shortcut Josh Yan 2024-05-21 16:55:09 -07:00
  • 3bade04e10 doc updates for the faq/troubleshooting (#4565) Patrick Devine 2024-05-21 15:30:09 -07:00
  • a6d0f443eb Merge pull request #4543 from ollama/mxyng/simple-safetensors v0.1.39-rc1 Michael Yang 2024-05-21 14:43:55 -07:00
  • 96236b7968 Merge pull request #4268 from ollama/pdevine/llama3 Michael Yang 2024-05-21 14:43:37 -07:00
  • 4434d7f447 Correct typo in error message (#4535) Sang Park 2024-05-22 05:39:01 +09:00
  • 171eb040fc simplify safetensors reading Michael Yang 2024-05-20 09:47:01 -07:00
  • 3591bbe56f add test Michael Yang 2024-05-21 11:28:16 -07:00
  • 34d5ef29b3 fix conversion for f16 or f32 inputs Michael Yang 2024-05-17 12:11:49 -07:00
  • bbbd9f20f3 cleanup Michael Yang 2024-05-15 14:55:57 -07:00
  • 547132e820 bpe pretokenizer Michael Yang 2024-05-15 11:53:14 -07:00
  • 2d315ba9a9 add missing file Patrick Devine 2024-05-08 16:56:18 -07:00
  • d355d2020f add fixes for llama Patrick Devine 2024-05-08 16:07:46 -07:00
  • c8cf0d94ed llama3 conversion Patrick Devine 2024-04-28 10:36:38 -07:00
  • 4730762e5c add safetensors version Patrick Devine 2024-04-24 18:32:01 -07:00
  • d88582dffd some changes for llama3 Patrick Devine 2024-04-18 16:00:20 -07:00
  • 2f81b3dce2 Merge pull request #4502 from ollama/mxyng/fix-quantize Michael Yang 2024-05-20 16:09:27 -07:00
  • 5cab13739e set llama.cpp submodule commit to 614d3b9 jmorganca 2024-05-20 15:28:17 -07:00
  • 8aadad9c72 updated updateURL Josh Yan 2024-05-20 15:24:32 -07:00
  • 807d092761 fix quantize file types Michael Yang 2024-05-17 11:29:04 -07:00
  • f36f1d6be9 tidy intermediate blobs Michael Yang 2024-05-20 14:58:27 -07:00
  • 8800c8a59b chore: fix typo in docs (#4536) alwqx 2024-05-21 05:19:03 +08:00
  • b4dce13309 Merge pull request #4330 from ollama/mxyng/cache-intermediate-layers Michael Yang 2024-05-20 13:54:41 -07:00
  • e15307fdf4 feat: add support for flash_attn (#4120) Sam 2024-05-21 06:36:03 +10:00
  • 3520c0e4d5 cache and reuse intermediate blobs Michael Yang 2024-05-10 15:48:41 -07:00
  • ccdf0b2a44 Move the parser back + handle utf16 files (#4533) Patrick Devine 2024-05-20 11:26:45 -07:00
  • 63a453554d go mod tidy jmorganca 2024-05-19 23:03:57 -07:00
  • 105186aa17 add OLLAMA_NOHISTORY to turn off history in interactive mode (#4508) Patrick Devine 2024-05-18 11:51:57 -07:00
  • ba04afc9a4 Merge pull request #4483 from dhiltgen/clean_exit Daniel Hiltgen 2024-05-17 11:41:57 -07:00
  • 7e1e0086e7 Merge pull request #4482 from dhiltgen/integration_improvements Daniel Hiltgen 2024-05-16 16:43:48 -07:00
  • 02b31c9dc8 Don't return error on signal exit Daniel Hiltgen 2024-05-16 16:25:38 -07:00
  • 7f2fbad736 Skip max queue test on remote Daniel Hiltgen 2024-05-16 16:24:18 -07:00
  • 5bece94509 Merge pull request #4463 from ollama/jyan/line-display Josh 2024-05-16 14:15:08 -07:00
  • 3d90156e99 removed comment Josh Yan 2024-05-16 14:12:03 -07:00
  • 5e46c5c435 Updating software for read me (#4467) Rose Heart 2024-05-16 15:55:14 -05:00
  • 583c1f472c update llama.cpp submodule to 614d3b9 (#4414) Jeffrey Morgan 2024-05-16 13:53:09 -07:00
  • 26bfc1c443 go fmt'd cmd.go Josh Yan 2024-05-15 17:26:39 -07:00
  • 799aa9883c go fmt'd cmd.go Josh Yan 2024-05-15 17:24:17 -07:00
  • 84ed77cbd8 Merge pull request #4436 from ollama/mxyng/done-part Michael Yang 2024-05-15 17:16:24 -07:00
  • c9e584fb90 updated double-width display Josh Yan 2024-05-15 16:45:24 -07:00
  • 17b1e81ca1 fixed width and word count for double spacing Josh Yan 2024-05-15 16:29:33 -07:00
  • 7e9a2da097 Merge pull request #4462 from dhiltgen/opt_out_build Daniel Hiltgen 2024-05-15 16:27:47 -07:00
  • c48c1d7c46 Port cuda/rocm skip build vars to linux Daniel Hiltgen 2024-05-15 15:56:43 -07:00
  • d1692fd3e0 fix the cpu estimatedTotal memory + get the expiry time for loading models (#4461) v0.1.38 Patrick Devine 2024-05-15 15:43:16 -07:00
  • 5fa36a0833 Merge pull request #4459 from dhiltgen/sanitize_env_log Daniel Hiltgen 2024-05-15 14:58:55 -07:00
  • 853ae490e1 Sanitize the env var debug log Daniel Hiltgen 2024-05-15 14:42:57 -07:00
  • f2cf97d6f1 fix typo in modelfile generation (#4439) Patrick Devine 2024-05-14 15:34:29 -07:00
  • c344da4c5a fix keepalive for non-interactive mode (#4438) Patrick Devine 2024-05-14 15:17:04 -07:00
  • 85a57006d1 check if name exists before create/pull/copy Michael Yang 2024-05-13 15:27:51 -07:00
  • c5e892cb3e update tests Michael Yang 2024-05-13 14:41:37 -07:00
  • 81fb06f530 more resilient Manifests Michael Yang 2024-05-09 10:00:18 -07:00
  • a385382ff5 filepath.Join Michael Yang 2024-05-08 15:56:40 -07:00
  • b8772a353f remove DeleteModel Michael Yang 2024-05-08 14:54:52 -07:00
  • c2714fcbfd routes: use Manifests for ListHandler Michael Yang 2024-05-06 16:34:13 -07:00
  • a2fc933fed update delete handler to use model.Name Michael Yang 2024-04-17 17:23:19 -07:00
  • 0e331c7168 Merge pull request #4328 from ollama/mxyng/mem Michael Yang 2024-05-14 13:47:44 -07:00
  • ac145f75ca return on part done Michael Yang 2024-05-14 12:41:03 -07:00
  • a4b8d1f89a re-add system context (#4435) Patrick Devine 2024-05-14 11:38:20 -07:00
  • 798b107f19 Fixed the API endpoint /api/tags when the model list is empty. (#4424) Ryo Machida 2024-05-15 03:18:10 +09:00
  • 6a1b471365 Merge pull request #4430 from dhiltgen/gpu_info Daniel Hiltgen 2024-05-14 10:59:06 -07:00
  • ec231a7923 Remove VRAM convergence check for windows Daniel Hiltgen 2024-05-14 09:48:13 -07:00
  • 7ca71a6b0f don't abort when an invalid model name is used in /save (#4416) Patrick Devine 2024-05-13 18:48:28 -07:00
  • 7607e6e902 Merge pull request #4379 from WolfTheDeveloper/main Josh 2024-05-13 18:08:32 -07:00
  • f1548ef62d update the FAQ to be more clear about windows env variables (#4415) Patrick Devine 2024-05-13 18:01:13 -07:00
  • 6845988807 Ollama ps command for showing currently loaded models (#4327) Patrick Devine 2024-05-13 17:17:36 -07:00
  • 9eed4a90ce Merge pull request #4411 from joshyan1/main Josh 2024-05-13 15:30:45 -07:00
  • f8464785a6 removed inconsistencies Josh Yan 2024-05-13 14:50:52 -07:00
  • 1d359e737e typo Michael Yang 2024-05-13 14:14:10 -07:00
  • 50b9056e09 count memory up to NumGPU Michael Yang 2024-05-10 14:40:37 -07:00
  • 91a090a485 removed inconsistent punctuation Josh Yan 2024-05-13 14:08:22 -07:00
  • 9c76b30d72 Correct typos. (#4387) 睡觉型学渣 2024-05-13 09:21:11 +08:00
  • 93f19910c5 Update LlamaScript to point to new link. Zander Lewis 2024-05-12 11:24:21 -04:00
  • 4ec7445a6f Revert "use post token" jmorganca 2024-05-11 22:19:14 -07:00
  • 0372c51f82 Merge pull request #4369 from ollama/mxyng/post-token Michael Yang 2024-05-11 19:29:14 -07:00
  • 0fec3525ad use post token Michael Yang 2024-05-11 19:13:16 -07:00
  • 41ba3017fd Fix OpenAI finish_reason values when empty (#4368) v0.1.37 Jeffrey Morgan 2024-05-11 15:31:41 -07:00
  • 8080fbce35 fix ollama create's usage string (#4362) todashuta 2024-05-12 06:47:49 +09:00
  • ec14f6ceda case sensitive filepaths (#4366) Michael Yang 2024-05-11 14:12:36 -07:00
  • c60a086635 Merge pull request #4331 from dhiltgen/fix_unit Daniel Hiltgen 2024-05-11 09:16:28 -07:00
  • 92ca2cca95 Revert "only forward some env vars" v0.1.36 jmorganca 2024-05-10 22:53:21 -07:00
  • 1e1634daca update go deps (#4324) Patrick Devine 2024-05-10 21:39:27 -07:00
  • 824ee5446f Fix envconfig unit test Daniel Hiltgen 2024-05-10 16:49:48 -07:00
  • 879e2caf8c Merge pull request #4329 from dhiltgen/zero_layers Daniel Hiltgen 2024-05-10 15:23:16 -07:00
  • c4014e73a2 Fall back to CPU runner with zero layers Daniel Hiltgen 2024-05-10 15:09:48 -07:00